画像から Excel へ

表の印刷文字を、画像をサーバーへ送らずに編集可能な表へ変換します。Tesseract.js がブラウザー内で文字を認識し、同じ高さの単語を行としてまとめ、横方向の大きな間隔で列を分けます。プレビューを確認して XLSX または CSV を保存してください。

画像を Excel に変換する方法

  1. 1

    表の画像をアップロード

    鮮明なスクリーンショット・スキャン・写真が最適です。まっすぐで明るい表が最も正確に読み取れます。

  2. 2

    ローカル OCR を実行

    選択した OCR 言語で Tesseract.js が印刷文字を認識します。画像はアップロードされません。

  3. 3

    推定した行と列を確認

    近い高さの単語を同じ行にし、横方向の大きな空きを新しい列とみなします。表構造を完全に解析する機能ではありません。

  4. 4

    XLSX または CSV を保存

    Excel・Google スプレッドシート・LibreOffice で開き、認識ミスや列ずれを修正してください。

良いソース画像の条件

要素 精度に最適 精度を下げる
鮮明さ くっきりピントが合っている ぼやけ・低解像度
照明 均一で反射なし 影・映り込み
角度 正面・水平 傾き・ゆがんだ写真
列間隔 列の間に明確な空きがある 密集・結合・入れ子のセル
文字 印刷・明瞭なフォント 手書き・装飾的なフォント

正確な制限、対応言語、プライバシー

入力できるのは実体が PNG、JPG/JPEG、WebP のファイルで、上限は 20 MB、各辺 8192 ピクセル、合計 24 メガピクセルです。OCR が対応する印刷文字は英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語です。ページの表示言語から画像内の言語は自動判定されないため、該当する OCR 言語を選んでください。

画像がこのブラウザーの外へ送信されることはありません。1 ページの通常表示ではメモリー内だけに保持されます。3 ステップ表示では、ページ移動のため画像と認識済みの行をこのサイトの IndexedDB に最長 30 分間保存します。ダウンロードまたは最初からやり直す操作で、それより早い削除を試みます。ブラウザーは選択した Tesseract 言語モデルを取得する場合がありますが、その通信に元画像は含まれません。

出力は OCR という 1 枚のシートを持つ XLSX ブックと、UTF-8 の CSV です。数式、結合セル、書式、罫線、意味上の見出しは復元しません。

実際に時間を節約できる場面

  • スキャンしたレポート、紙でしか受け取っていないもの。
  • スクリーンショット、コピーできないダッシュボードや表のもの。
  • 領収書・請求書・明細の写真、合計を出す必要があるもの。
  • 古い印刷物、どこにもデジタルの原本がないもの。

必ず結果を確認する

光学文字認識は優秀ですが完璧ではありません。0/O1/l のような文字は誤読されることがあり、結合セルや特殊なセルはずれることがあります。頼りにする前に、スプレッドシートを画像と照らし合わせてざっと確認してください。数セルを直すほうが、表全体を打ち直すよりはるかに速いはずです。

よりきれいに抽出するためのヒント

  • アップロード前に画像を表だけにトリミングします。
  • 傾いた写真をまっすぐにして、行が水平になるようにします。
  • かすれた印刷物はコントラストを上げます。

よくある質問

たいていは大半が正確ですが、光学文字認識は完璧ではありません。似た文字や特殊なセル配置は誤りが生じることがあります。必ずスプレッドシートを元の画像と照合し、外れた値を修正してください。

罫線が見える印刷された表を、鮮明で均一に明るく、正面から撮影したものです。ぼやけた・傾いた・手書きの表は正確に読み取るのがはるかに難しくなります。

手書きは信頼できません。このツールは印刷物や画面上のテキスト向けに作られています。丁寧なブロック体の大文字なら動作することもありますが、より多くのセルの修正を見込んでください。

XLSX ブックまたは UTF-8 の CSV をダウンロードできます。どちらにもプレビューと同じ推定済みの行と列が入り、Excel・Google スプレッドシート・LibreOffice Calc で開けます。

関連ツール