Zdjęcia skompresowane do jednego TXT
Umieść zdjęcia JPEG w jednym ZIP. OCR czyta je w kolejności nazw plików i dopisuje rozpoznane słowa do jednego pliku tekstowego, z separatorem na granicy każdej strony. Wszystko, co dotyczy wyglądu zdjęcia — światło, kolor papieru, charakter pisma — znika; zostają przepisane słowa w kolejności czytania.
To właśnie spłaszczenie sprawia, że folder zdjęć z aparatu staje się użyteczny dla wszystkiego, co oczekuje tekstu na wejściu — od formuły w arkuszu kalkulacyjnym po wyszukiwanie w wierszu poleceń — a żadne z tych narzędzi w ogóle nie potrafi czytać plików JPEG. Stały wiersz znacznika dzieli plik na sekcje dla poszczególnych zdjęć, a przejście do szóstej strony oznacza wyszukanie szóstego wystąpienia znacznika zamiast liczenia akapitów na oko, co sprawdza się nawet w partii liczącej ponad pięćdziesiąt sfotografowanych stron.
OCR dokumentów wielostronicowych
Przetwarzaj całe zestawy dokumentów naszymi wielostronicowymi narzędziami OCR. Umieść obrazy stron w jednym ZIP, nazwane w kolejności stron, i otrzymaj jeden wynik — przeszukiwalny PDF, dokument Word lub tekst ze wszystkimi stronami. Idealne do digitalizacji książek, raportów, korespondencji i archiwów.
W przypadku dużych dokumentów przetwarzanie wsadowe znacznie oszczędza czas w porównaniu z konwersją strona po stronie. Nasze narzędzia zachowują kolejność stron, radzą sobie ze zmienną jakością obrazu między stronami i tworzą jednolity wynik gotowy do przeglądu i użycia. Oryginalny układ każdej strony jest zachowywany w wyniku.
Dokładność przy partii z aparatu
Jakość zdjęcia decyduje o tej konwersji bardziej niż sam etap OCR: odblask na laminowanej stronie, niepewne zdjęcie z ręki czy nierówne światło mogą zgubić słowa lub zniekształcić znaki, a w przeciwieństwie do sformatowanego dokumentu nie pozostaje żaden wizualny układ, który pomógłby dostrzec, gdzie rozpoznawanie się pomyliło.
Zanim zaufasz całej partii, przejrzyj surowy tekst w porównaniu ze zdjęciem, które pamiętasz jako rozmyte lub słabo oświetlone; brakujące słowo w zwykłym tekście łatwo przeoczyć przy szybkim czytaniu, ponieważ nie ma zepsutego formatowania sygnalizującego, że na tej stronie coś poszło nie tak. Sfotografowana faktura lub arkusz z widocznymi liniami kolumn i tak trafia do pliku .txt jako jeden ciąg słów, z wartościami ułożonymi w takiej kolejności od lewej do prawej, w jakiej OCR przeszedł przez zdjęcie, więc suma, która na papierze leżała pod własnym nagłówkiem kolumny, może po zniknięciu kolumn znaleźć się tuż obok niepowiązanego słowa.
Fotografowanie pod czysty tekst
Równe, rozproszone oświetlenie w całej partii ma tu większe znaczenie niż przy konwersji do sformatowanego dokumentu, ponieważ nie ma później etapu formatowania, który zamaskowałby niedoskonałą stronę; przepisane słowa stanowią cały wynik, więc wszystko, co OCR odczyta błędnie, pojawi się wprost w końcowym pliku. Plik zapisywany jest jako UTF-8 z podziałami linii w stylu uniksowym, co poprawnie obejmuje znaki z akcentami i większość symboli przy imporcie do skryptu lub arkusza kalkulacyjnego; jeśli zaimportowany tekst nadal wygląda na zniekształcony, sprawdź, czy sam etap importu odczytuje UTF-8, zamiast domyślnie przechodzić na inne kodowanie.
Przed spakowaniem do ZIP nazwij pliki w kolejności stron (01, 02, 03…): strony idą za nazwami plików, a później nie ma kroku zmiany kolejności.