JPEG do TXT (OCR)

Wyodrębniaj tekst ze zdjęć JPEG i obrazów za pomocą OCR. Konwertuj sfotografowane dokumenty, paragony i tablice na pliki zwykłego tekstu do edycji i wyszukiwania.

Wybierz język tekstu, aby rozpoznawany był właściwy alfabet. Tryb automatyczny sam rozpoznaje alfabet na każdej stronie.

JPG

lub przeciągnij i upuść plik tutaj

Prześlij swój obraz JPEG

Szybka konwersjaBezpieczne przetwarzanieBez rejestracji

Zamiana zdjęcia JPEG w plik TXT

Wgraj zeskanowany PDF, zdjęcie lub obraz. OCR odczytuje tekst z pikseli i przekształca go w edytowalne znaki. Działa z drukowanym tekstem w wielu językach. Radzi sobie z niskiej jakości skanami, przekrzywionymi stronami i różnorodnymi czcionkami.

Zdjęcie zawiera więcej szumu wizualnego niż cyfrowy zrzut ekranu — cienie, lekkie przechylenie, fakturę papieru — więc etap rozpoznawania musi najpierw sobie z tym poradzić, zanim utworzy plik tekstowy. Sam wynik to jednak zwykła lista wierszy i słów, bez prób odtworzenia kolumn, wcięć czy odstępów ze sfotografowanej strony oryginału.

Po co zamieniać zdjęcia na pliki tekstowe

Zeskanowane dokumenty to tylko obrazy. Nie da się ich przeszukiwać, kopiować z nich tekstu ani ich edytować. OCR zamienia obrazy w prawdziwy tekst. Sprawia, że stare papierowe archiwa stają się przeszukiwalne. Pozwala wyodrębniać dane z zeskanowanych formularzy. Konwertuje drukowane materiały na edytowalne pliki.

Niezbędne do digitalizacji umów, paragonów, dokumentów historycznych i stron książek. Czytniki ekranu potrzebują prawdziwego tekstu, aby czytać na głos — OCR sprawia, że zeskanowane dokumenty stają się dostępne. Oszczędza godziny w porównaniu z ręcznym przepisywaniem.

Szum zdjęcia kontra czysty tekst

Kompresja JPEG i warunki fotografowania wpływają na dokładność, z jaką zdjęcie zamienia się w tekst: miękkie ustawienie ostrości, rozmycie ruchu lub JPEG zapisany w niskiej jakości mogą zlać ze sobą drobne kreski odróżniające podobne litery, co daje więcej błędnie odczytanych znaków niż w przypadku równoważnego skanu czy zrzutu ekranu. Ponieważ plik .txt pomija całe formatowanie, nie ma nic, co wizualnie oznaczyłoby błędnie odczytane słowo, gdy już się pojawi.

Równe oświetlenie, kąt prosto z góry i ostre ujęcie mają największy pojedynczy wpływ na wynik w pliku .txt, większy niż liczba megapikseli aparatu. Ostre zdjęcie z przeciętnego aparatu telefonu, zrobione dostatecznie blisko, by tekst wypełnił kadr, zwykle przewyższy szerokie, odległe zdjęcie z lepszego aparatu, na którym tekst zajmuje tylko niewielką część obrazu.

Fotografowanie dla czystego wyniku TXT

Podejdź na tyle blisko, by tekst wypełniał większość kadru, ponieważ odległe zdjęcie zmusza rozpoznawanie do pracy z mniejszą liczbą pikseli na literę niż bliskie, docięte ujęcie. Fotografuj stronę prosto z góry, a nie pod kątem, i korzystaj z naturalnego światła dziennego lub równomiernego oświetlenia pokoju zamiast pojedynczej lampy, która pozostawia jedną stronę strony ciemniejszą.

Trzymaj aparat stabilnie lub oprzyj go o coś solidnego, ponieważ nawet niewielkie rozmycie ruchu wystarczy, by zmiękczyć krawędzie i pomylić podobne litery, jak m i rn czy l i 1. Przy dokumencie z kilkoma stronami zrób jedno zdjęcie na stronę, zamiast próbować zmieścić cały stos w jednym szerokim ujęciu, i przekonwertuj każdą osobno dla czystszego pliku tekstowego.