Foto compresse in un unico TXT
Metti le foto JPEG in un unico ZIP. L'OCR le legge in ordine di nome file e aggiunge le parole riconosciute a un unico file di testo, con un separatore a ogni confine di pagina. Tutto ciò che riguarda l'aspetto della foto — luce, colore della carta, calligrafia — sparisce; restano le parole trascritte nell'ordine di lettura.
È proprio questo appiattimento a rendere una cartella di foto della fotocamera utilizzabile da qualsiasi strumento che si aspetta testo in ingresso, da una formula di foglio di calcolo a una ricerca da riga di comando, nessuno dei quali sa leggere un JPEG. Una riga indicatore fissa divide il file in sezioni per ogni foto, e per andare a pagina sei basta cercare la sesta occorrenza di quell'indicatore invece di contare i paragrafi a occhio, cosa che funziona anche con un lotto di oltre cinquanta pagine fotografate.
OCR di Documenti Multi-Pagina
Elabora interi insiemi di documenti con i nostri strumenti OCR multipagina. Metti le immagini delle pagine in un unico ZIP, con nomi in ordine di pagina, e ottieni un risultato unico: un PDF ricercabile, un documento Word o testo con tutte le pagine. Ideale per digitalizzare libri, report, corrispondenza e archivi.
Per documenti grandi, l'elaborazione batch risparmia tempo significativo rispetto alla conversione pagina per pagina. I nostri strumenti mantengono l'ordine delle pagine, gestiscono qualità delle immagini variabile tra le pagine e producono output consolidato pronto per revisione e uso. Il layout originale di ogni pagina è preservato nell'output.
Accuratezza da un lotto di scatti
La qualità della foto guida questa conversione più del passaggio OCR stesso: un riflesso su una pagina plastificata, uno scatto a mano libera tremolante o una luce irregolare faranno perdere parole o confonderanno caratteri, e a differenza di un documento formattato non rimane alcun layout visivo dopo per aiutarti a individuare dove il riconoscimento è andato storto.
Scorri il testo grezzo confrontandolo con una foto che ricordi essere sfocata o mal illuminata prima di fidarti del lotto; una parola mancante nel testo semplice è facile da perdere a una lettura veloce, poiché non c'è formattazione rotta a segnalare che qualcosa è andato storto in quella pagina. Una fattura o un foglio di calcolo fotografato con righe di colonna visibili esce comunque come un'unica sequenza di parole nel file .txt, con i valori posizionati nell'ordine da sinistra a destra in cui l'OCR ha percorso la foto, così un totale che stava sotto la propria intestazione di colonna sulla carta può finire proprio accanto a una parola non correlata una volta che le colonne sono sparite.
Scattare per un output in testo semplice
Un'illuminazione uniforme e diffusa in tutto il lotto conta qui più che per una conversione in documento formattato, poiché non c'è un passaggio di formattazione successivo a mascherare una pagina imperfetta; le parole trascritte sono l'intero output, quindi qualsiasi cosa l'OCR legga male appare direttamente nel file finale. Il file viene salvato come UTF-8 con interruzioni di riga in stile Unix, il che copre correttamente i caratteri accentati e la maggior parte dei simboli per uno script o un'importazione in un foglio di calcolo; se il testo importato appare ancora corrotto, verifica che il passaggio di importazione stesso legga in UTF-8 invece di ricadere su una codifica predefinita diversa.
Dai ai file nomi in ordine di pagina (01, 02, 03…) prima di comprimerli in ZIP: le pagine seguono i nomi e poi non c'è un passaggio per riordinarle.