検索可能なPDF作成

スキャンした PDF を選択

PDFのみ · 10 MB

PDF のみ、最大 10 MB・10 ページ

スキャンしたPDFは、実際にはPDFコンテナに収めた画像の束にすぎないため、文字をハイライト・コピー・検索できません。このツールは、各ページに対して光学文字認識(OCR)をブラウザ内で実行し、結果を元のページに合わせた見えないテキスト層として追加します。元のページの見た目は保たれ、Ctrl+Fや文字選択で認識された語を利用できます。認識には誤りがあり得るうえ、この出力はタグ付きのアクセシビリティPDFではありません。重要な文字はスキャンと照合してください。

スキャンしたPDFをOCRする方法

  1. 1

    スキャンをアップロードする

    スキャンしたPDF(契約書、請求書、保管された報告書)をドラッグします。印刷された文字が最も適しています。手書きは適しません。

  2. 2

    言語を選ぶ

    文書の言語(英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語)を選ぶと、OCRエンジンが適切な文字モデルを読み込みます。

  3. 3

    認識を実行する

    各ページはブラウザ内で高解像度に描画され、OCRエンジンに渡されます。長い文書では数分かかることがあります。

  4. 4

    テキスト層を埋め込む

    認識された単語を、元のページに位置を合わせた見えない層として配置するため、各ページの見た目は変わりません。

  5. 5

    新しいPDFをダウンロードする

    元のスキャンを保ったまま、あらゆる最新のリーダーで検索できるようになったPDFが得られます。

OCRがうまくいくとき(うまくいかないとき)

OCRの品質はスキャンの状態に左右されます。重要な氏名、数字、法的な文言は必ず元のページと照合してください。

入力 期待できること
きれいな印刷スキャン 良い結果が得られることが多いですが、重要な文字は校正してください。
印刷ページの写真 焦点、照明、ページの角度によって結果が変わります。
古い本や色あせたタイプ印刷 認識された文字を注意深く確認してください。
手書きや筆記体 安定した対応はしていません。
レシートや感熱式プリンターの出力 数字や薄い文字を注意深く確認してください。
裏写りの強い文字 結果が不完全または不正確になることがあります。

検索可能なPDFと画像のみのPDF

  • 画像のみのPDF:純粋なビットマップで、文字がありません。スキャナーが既定で作るものです。
  • 検索可能なPDF:ビットマップに見えないテキスト層を加えたもの(このツールの出力)。見た目は同じで、Ctrl+Fが使えます。
  • PDF/A:フォントを埋め込み外部リソースを禁じる、保管用のPDFのサブセットで、裁判所や文書館でよく求められます。このツールが作るのは通常の検索可能なPDFであり、認証されたPDF/Aではありません。運用でPDF/Aが必要なら、専用のPDF/Aツールで変換・検証してください。

よい結果を得るコツ

  • まずは300 DPI程度でスキャンする。 読み取れる細部と処理時間のバランスとして役立つことが多く、高解像度ほど時間とメモリを使います。
  • OCRの前に傾きを直す。 多くのスキャナーには自動回転があります。わずかな傾きでも認識品質を下げることがあります。
  • 1回につき1言語。 エンジンは一度に1言語しか認識しないので、主要な言語を選んでください。二言語の文書は言語ごとに1回ずつ実行し、より良い結果を残しましょう。
  • 必ず原本を残す。 OCRは小さな誤りを生みます。見えない層はあくまで便宜であり、証拠ではありません。

よくある質問

元のページ内容は保持されます。認識された文字は、それに位置を合わせた見えない層として追加されるため、ページの見た目は変わらないはずです。厳密な見た目の再現が重要な場合は、結果を確認してください。

ラテン文字の7言語です。英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語。文書に合うものを選んでください。キリル文字、アラビア文字、CJK(中国語・日本語・韓国語)などの文字はこのツールでは利用できません。

安定しては読めません。このツールは印刷された文字を対象にしています。手書き文字の認識は別の技術なので、手書きの資料は別途確認または書き起こしをしてください。

いいえ。出力は通常の検索可能なPDFで、元のページ画像に見えないOCRテキスト層を加えたものです。認証された保管用のPDF/Aファイルではありません。運用でPDF/Aが必要なら、専用のPDF/Aツールで結果を変換・検証してください。

OCRはすべてブラウザ内で実行されるため、認識のために元のPDFがサーバーへ送られることはありません。通常のローカルダウンロードもお使いの端末に残ります。「ダウンロードページを作成」を選んだ場合だけ、完成した検索可能なPDFが当社のサーバーにアップロードされます。元のPDFはローカルに残り、アップロードした結果は最長7日間保持されます。

関連ツール