PNG skompresowane do jednego pliku TXT
Pliki PNG z twojego ZIP są czytane w kolejności nazw, a rozpoznane słowa z każdego obrazu trafiają do jednego pliku .txt w UTF-8, z linią rozdzielającą w miejscu, gdzie kończy się jeden obraz, a zaczyna następny. Formatowanie, czcionki i układ są odrzucane; zostają same słowa.
To świadomy kompromis: plik .txt nie ma stylów do zachowania, więc wybór go zamiast dokumentu Word ma sens tylko wtedy, gdy naprawdę potrzebujesz surowego tekstu z partii zrzutów ekranu, a nie dokumentu, który wciąż wygląda jak oryginały. Każdy separator powtarza między stronami ten sam krótki wiersz tekstu, więc po otwarciu pliku w dowolnym edytorze i wyszukaniu dokładnie tego wiersza od razu trafiasz na początek wybranego obrazu źródłowego, zamiast przewijać całą partię na oko.
OCR dokumentów wielostronicowych
Przetwarzaj całe zestawy dokumentów naszymi wielostronicowymi narzędziami OCR. Umieść obrazy stron w jednym ZIP, nazwane w kolejności stron, i otrzymaj jeden wynik — przeszukiwalny PDF, dokument Word lub tekst ze wszystkimi stronami. Idealne do digitalizacji książek, raportów, korespondencji i archiwów.
W przypadku dużych dokumentów przetwarzanie wsadowe znacznie oszczędza czas w porównaniu z konwersją strona po stronie. Nasze narzędzia zachowują kolejność stron, radzą sobie ze zmienną jakością obrazu między stronami i tworzą jednolity wynik gotowy do przeglądu i użycia. Oryginalny układ każdej strony jest zachowywany w wyniku.
Co traci zwykły plik
Ponieważ PNG jest bezstratny, silnik OCR otrzymuje do odczytu czysty obraz, więc dokładność na poziomie słów dla tego rodzaju danych wejściowych jest zwykle tak dobra, jak w każdym innym narzędziu opartym na PNG; różnica leży tu wyłącznie po stronie wyniku, gdzie nagłówki, tabele i podziały linii wewnątrz akapitu nie są zachowywane jako struktura.
Jeśli źródłowe pliki PNG zawierają tabelę, spodziewaj się, że wynik .txt zleje komórki w kolejności czytania, zamiast utrzymać ich wyrównanie w kolumnach; to oczekiwane zachowanie eksportu do zwykłego tekstu, a nie błąd rozpoznawania, i to główny powód, by ręcznie sprawdzić stronę bogatą w tabele, zanim zaufasz plikowi do dalszego parsowania. Powtarzająca się linia nagłówka lub stopki na każdym pliku PNG źródłowym, taka jak numer strony czy nazwa firmy, pojawia się w pliku .txt raz na stronę, zamiast zostać scalona, więc czterdziestostronicowa partia może skończyć z tą samą krótką linią rozsianą czterdzieści razy w środku tekstu.
Jak uzyskać czysty wynik tekstowy
Przed spakowaniem do ZIP nazwij pliki w kolejności stron (01, 02, 03…): strony idą za nazwami plików, a później nie ma kroku zmiany kolejności. Wynik używa uniksowych znaków końca linii, które nowoczesne edytory i języki skryptowe czytają od razu; stare narzędzie Windows oczekujące par CR/LF może wymagać szybkiej konwersji.
Zwróć uwagę na kodowanie, jeśli Twoje pliki PNG zawierają znaki spoza alfabetu łacińskiego lub symbole; UTF-8 obejmuje zdecydowaną większość przypadków, ale narzędzie dalej w potoku ustawione na inne kodowanie może nadal błędnie odczytać znaki poprawnie rozpoznane przez OCR.