JPEG写真をTXTに変換する
スキャンされたPDF、写真、画像をアップロードしてください。OCRはピクセルからテキストを読み取り、編集可能な文字に変換します。複数言語の印刷テキストに対応しています。低画質のスキャン、傾いたページ、さまざまなフォントにも対応します。
写真にはデジタルのスクリーンショットより多くの視覚的ノイズ(影、わずかな傾き、紙の質感)が含まれるため、認識処理はテキストファイルを作成する前にまずそれらを乗り越える必要があります。それでも出力自体は行と単語を並べただけのシンプルなもので、撮影した元のページの段組み、インデント、間隔を再現しようとはしません。
写真をテキストファイルにする理由
スキャンされた文書は単なる画像です。検索も、テキストのコピーも、編集もできません。OCRは画像を実際のテキストに変換します。古い紙のアーカイブを検索可能にします。スキャンされたフォームからデータを抽出できます。印刷資料を編集可能なファイルに変換します。
契約書、領収書、歴史的文書、書籍のページのデジタル化に不可欠です。スクリーンリーダーは読み上げに実際のテキストを必要とします——OCRはスキャンされた文書をアクセシブルにします。手動での打ち直しに比べて何時間も節約できます。
写真特有のノイズとクリーンなテキストの違い
JPEGの圧縮とカメラ撮影時の条件は、いずれも写真からテキストへの変換精度に影響します。ピントの甘さや被写体ブレ、低画質で保存されたJPEGは、似た文字を区別する細かい線を潰してしまい、スキャンやスクリーンショットの場合よりも誤認識の文字が増える原因になります。.txtファイルはすべての書式情報を失うため、誤読された単語が発生しても、それを視覚的に見分ける手がかりが一切残りません。
.txtの結果を最も大きく左右するのは、カメラの画素数よりも、均一な照明、正面から捉えた角度、そしてピントの合った撮影です。一般的なスマートフォンのカメラでも、テキストがフレームいっぱいに収まるくらい近づいて撮影された鮮明な写真は、テキストが画像のごく一部しか占めていない、高性能カメラによる離れた広角写真よりも、たいてい良い結果を出します。
きれいなTXT出力のための撮影方法
テキストがフレームの大部分を占めるくらい近づいて撮影しましょう。離れて撮影すると、文字1つあたりのピクセル数が減り、認識の精度が下がってしまいます。ページは斜めからではなく真上から撮影し、片側だけが暗くなってしまう単一のランプではなく、自然光や部屋全体を均一に照らす照明を使うようにしてください。
カメラはしっかりと固定するか、何か安定したものに添えて構えてください。わずかな手ブレでも輪郭がぼやけ、mとrn、lと1のような似た文字を混同する原因になります。複数ページの資料の場合は、まとめて一枚の広角写真に収めようとせず、1ページごとに1枚撮影し、それぞれを個別に変換することで、よりきれいなテキストファイルになります。