表の画像が表計算シートになるまで
画像はOCRで読み取られ、認識された単語が、それが置かれている枠とともに返されます。行は同じ高さに並ぶ単語から、列は表全体を貫く縦の空きから決まります。
罫線は文字として読まれるのではなく捨てられるため、枠のある表が余分な縦棒だらけで届くことはありません。ダウンロードできるのは本物のグリッドで、1つの値が1つのセルに入ります。
読み取りの精度を決めるもの
パソコン上で撮ったスクリーンショットや、300 DPIのフラットベッドスキャンは、ほぼ完璧に読み取れます。文字が鮮明で、線がまっすぐで、列が実際の空きで分かれているからです。
画面や紙をカメラで撮った写真は難しくなります。遠近で行がゆがみ、光の反射が文字を消し、スマートフォンの影が列に入り込みます。アップロードする前に写真の傾きを直して切り抜くか、平らな状態で撮り直してください。
このツールが向いている場面
チャットにスクリーンショットで届いた表、画像としてしか残っていない報告書のページ、数値を表計算シートで使いたいスキャン済みの帳票などです。
数値がテキストレイヤーを持つPDFの中にある場合は、PDFをExcelに変換するツールのほうが適しています。ピクセルから文字を認識するのではなく、テキストを直接読み取るからです。
知っておきたい制限
結果はフラットなグリッドです。結合セルは、そのセルが覆う範囲の最初のセルに書き込まれます。色やフォント、数式は復元されません。画像にはそれらが含まれていないからです。
文字はラテン文字として読み取ります。これは英語とその他の西ヨーロッパの言語をカバーします。値ではなく文章が並んでいる表や、表が写っていない画像は、雑音だらけのファイルではなくメッセージで断られます。
関連ツール
- PDFをExcelに変換 — テキストを選択できるPDF向け
- PDFをCSVに変換 — 同じ抽出処理で、出力はプレーンテキスト
- AI PDFをExcelに変換 — 表を手で選び、書き出す前にグリッドを直せます