Извлечь текст из JPEG (OCR)

Извлечение текста из нескольких JPEG-фотографий и просмотр объединённых результатов. Копирование OCR-текста или скачивание.

Укажите язык текста, чтобы распознавание шло в нужном алфавите. Автоматический режим сам определяет алфавит на каждой странице.

JPG

или перетащите файл сюда

Загрузите ваше изображение JPEG

Быстрая конвертацияБезопасная обработкаБез регистрации

Фото в текст для вставки

Сложите фото JPEG в один ZIP, назвав их в порядке чтения (01.jpg, 02.jpg…). OCR извлекает слова из каждого фото в порядке имён файлов и выдаёт общий результат текстом, который можно сразу выделить и вставить куда нужно, — без скачивания файла.

Фотографии обрабатываются вместе, поэтому во вставленном тексте страницы идут в том порядке, в котором вы их снимали, а между ними стоит разделитель — так видно, где закончилась одна сфотографированная страница и началась следующая. Разделитель — это строка «--- Page Break ---», поэтому её легко найти поиском или удалить все сразу одной заменой.

Многостраничное распознавание документов OCR

Обрабатывайте целые наборы документов нашими многостраничными OCR-инструментами. Сложите изображения страниц в один ZIP, назвав их по порядку, и получите единый результат — PDF с поиском, документ Word или текст со всеми страницами. Это идеально для оцифровки книг, отчётов, переписки и архивных записей.

Для больших документов пакетная обработка экономит значительное время по сравнению с постраничной конвертацией. Наши инструменты сохраняют порядок страниц, обрабатывают различное качество изображений на разных страницах и производят консолидированный результат, готовый к просмотру и использованию. Оригинальный макет каждой страницы сохраняется в выходном файле.

Что стоят вам снимки с камеры

Условия съёмки здесь важнее для точности, чем для партии PNG: блики, смазывание и неровное освещение снижают точность распознавания, а поскольку результат — обычный текст без какой-либо вёрстки, неверно распознанное слово сливается с окружающим предложением, а не выделяется, как это могло бы быть в отформатированном документе.

Прежде чем полагаться на вставленный текст в чём-то важном, сверьте его с фото, которое было сложнее всего снять чисто — обычно это то, что сделано под углом или при смешанном освещении, поскольку именно на этой странице выше всего риск пропущенного слова. Сфотографированный чек или таблица с чёткими линиями столбцов всё равно вернётся как один сплошной поток слов после вставки, со значениями в том порядке, в каком их прочитал OCR, а не в исходных позициях по столбцам, поэтому цифра, стоявшая на бумаге под заголовком, в обычном тексте может оказаться рядом с не связанным с ней словом.

Как снимать фото для копирования и вставки

Держите телефон параллельно странице и следите за ровным светом по всей партии; поскольку после распознавания нет этапа форматирования, который бы поймал кривую строку, то, что OCR прочитает с перекошенного или затенённого фото, окажется точно тем, что попадёт в ваш вставленный текст. Твёрдая рука во время съёмки экономит больше правок потом, чем любая настройка этого инструмента.

Перед упаковкой в ZIP назовите файлы по порядку страниц (01, 02, 03…): страницы идут по именам файлов, и переставить их потом нельзя.