ファイルはお使いの端末に残ります

ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。

データの取り扱いについて

OCR PDF:検索可能なPDFの作成

10ページ・10MiBまでのスキャンしたレポートPDFに、日本語・英語・スペイン語・ロシア語の選択可能なテキストを追加し、内容を検索・引用できるようにします。 ファイルはブラウザー内にとどまります。

認識用ファイルは初回に約26MBで、これに言語データが加わります。

PDF・10MiBまで、10ページまで。テキストは1MiBまで、検索可能なPDFは30MiBまで。

認識されたテキスト

例を試す

サンプルをダウンロード

言語は「日本語」を選択します。PDFをダウンロードして、請求書、148.50、納品、2048を検索してください。2ページともサンプルと同じ見た目で、テキストを選択してコピーできます。

結果の見方

各ページは画像として順番に認識されます。英語、ロシア語、混在の認識に対応しています。OCRは文字、数字、列、表を誤って読み取ることがあるため、結果を確認してください。 レンダリングしたページ画像と、見えないテキスト層から、新しいPDFを作成します。表示上のページサイズと回転は保持されます。フォーム、リンク、しおり、添付ファイル、デジタル署名は保持されません。既存のテキストは再度認識され、画像の品質はレンダリング解像度に制限されます。

ページは1枚あたり最大4メガピクセルでレンダリングされます。読み込みと各処理ステップは90秒まで、ジョブ全体は10分で停止します。空白のページはテキスト内に記されます。処理に失敗した場合や、テキストが認識されなかった場合は、ダウンロードは提供されません。

保護されたPDFですか?先にパスワードでロックを解除してください。

初回は、変換用のファイルをダウンロードするため、時間がかかることがあります。失敗した場合は、接続を確認するか、より小さなファイルを試してください。「キャンセル」で実行中の処理を止められます。別のファイルを選んで、もう一度実行することもできます。

エンジンのライセンスとソースコード

実用ガイド

スキャンから文章を検索し、引用

  1. スキャンしたレポートを、10ページ・10MiB以内で選択してください。
  2. 認識する言語として、日本語、英語、スペイン語、ロシア語から選んでください。
  3. 結果から見出しを検索し、テキストレイヤーを確認してください。

この例を試す

英語の4ページのスキャン済み会議サマリーを認識します。3ページ目にある決定事項の見出しを検索すると、できあがったPDFで見つかるはずです。

始める前に: 認識に対応するのは日本語・英語・スペイン語・ロシア語のみで、10ページ・10MiBまでです。解像度の低いスキャンでは、認識の誤りが出ることがあります。