Извлечь текст из JPEG (OCR)

Извлечение текста из JPEG-фотографий и мгновенный просмотр результатов. Копирование распознанного текста или скачивание. Идеально для сфотографированных документов.

Укажите язык текста, чтобы распознавание шло в нужном алфавите. Автоматический режим сам определяет алфавит на каждой странице.

JPG

или перетащите файл сюда

Загрузите ваше изображение JPEG

Быстрая конвертацияБезопасная обработкаБез регистрации

Быстро копируем текст с фото

OCR (оптическое распознавание символов) анализирует изображения текста и преобразует их в фактические редактируемые символы. Когда вы загружаете отсканированный документ или фотографию, движок OCR исследует шаблоны пикселей для идентификации букв, цифр и символов. Современный OCR использует продвинутые алгоритмы для распознавания текста даже в сложных условиях: низкое разрешение, перекошенные страницы, различные шрифты и сложные макеты с колонками, таблицами и смешанным содержимым.

Распознавание читает фото как есть и показывает текст на странице в порядке чтения. Держите камеру параллельно тексту: на многострочной этикетке или в прайсе даже небольшой наклон может перемешать строки. Дальше выделить строку-другую и вставить в поиск, переводчик или сообщение — дело секунд, ради этого и пропущен шаг со скачиванием файла.

Зачем обходиться без файла ради фото

Отсканированные документы и PDF на основе изображений содержат только картинки текста — вы не можете искать, копировать или редактировать их. OCR преобразует эти изображения в реальный текст, делая документы поисковыми, редактируемыми и доступными. Когда вам нужно найти конкретное содержимое среди тысяч отсканированных страниц, OCR делает это возможным. Цифровые архивы, системы управления документами и рабочие процессы комплаенса зависят от OCR для превращения отсканированного содержимого в полезное.

Помимо поиска, OCR позволяет извлекать данные из бумажных документов: оцифровывать контракты для анализа, извлекать данные из форм, конвертировать печатные материалы в редактируемый текст для повторного использования. Требования доступности часто требуют поискового текста для пользователей с нарушениями зрения, использующих программы чтения с экрана. OCR соединяет бумажные архивы и цифровые рабочие процессы.

Насколько надёжно быстрое чтение фото

Для одной строки или короткого фрагмента фото работает почти так же хорошо, как скан, поскольку там мало содержимого, которое могли бы нарушить проблемы с освещением или углом съёмки, — чётко освещённая уличная табличка или этикетка товара обычно распознаётся точно с первой попытки. Чем больше текста и визуального шума вокруг него, тем заметнее в результате начинают проявляться пропущенные или неверные символы из-за дрожащего угла съёмки или тусклого света.

Блики — самая частая проблема при быстром чтении с фото, особенно на глянцевых вывесках, заламинированных меню или при фотографировании экрана телефона вместо прямого скриншота. Небольшой наклон редко имеет значение для одной короткой строки, но для абзаца или целой этикетки с несколькими строками камера, параллельная поверхности, заметно повышает долю текста, которая распознаётся верно.

Снимки лучше для быстрого чтения

Заполните кадр именно тем текстом, который нужен, а не всем окружением, и держите телефон параллельно поверхности, чтобы избежать растяжения из-за наклонного угла. Фокусировка касанием по тексту перед съёмкой помогает на телефонах, которые иначе фокусируются на фоне вместо нужных вам букв.

Немного сместитесь в сторону, если в предпросмотре телефона видите отражение или блик поверх текста, — одного этого обычно достаточно, чтобы исправить большинство быстрых фото вывесок или этикеток без дополнительного редактирования. Для всего длиннее одной-двух строк сделайте второй, более близкий снимок именно самого сложного участка, а не полагайтесь на один общий кадр для всего.