ファイルはお使いの端末に残ります
ファイルの処理はブラウザー内で行われ、当社のサーバーにはアップロードされません。サイトは処理エンジンをダウンロードしたり、ファイルの内容を含まない利用状況やフィードバックのイベントを送信したりすることがあります。
データの取り扱いについてPDFからHTML
検索できる報告書のPDFをHTMLに変換します。軽量なレビュー向けに、どのブラウザーでも開ける単独のテキストのコピーを作ります。書体、図、表は保持されません。
サンプルは合成データです。実行する前に操作の設定を確認してください。
ドキュメントはこの端末に残ります。ツールのダウンロードと利用統計には、ファイルの内容は含まれません。
端末での制限: 1ファイルの最大サイズ: 10 MB
ファイルはお使いのブラウザー内で処理されます。このサイトにはアップロードされません。
実践ガイド
ローカルのHTMLファイルで、報告書の文言を確認する
- 選択できるテキストを含む報告書を選択してください。
- HTMLを書き出し、保存したファイルをローカルで開いてください。
- 各ページのセクションを確認し、重要な記述をPDFと見比べてください。
この例を試す
4ページの提案書をHTMLに書き出します。ローカルで開き、テキスト表示を回覧する前に、範囲と料金の記述がそれぞれのページのセクションに残っていることを確認してください。
変更前
- テキストを含むPDFのページ
変更後
- HTMLのページセクション
始める前に: 書き出しでは、報告書の書体、図、表は保持されません。画像のみのテキストも認識されません。
元のPDFで作業を続ける得られる結果
埋め込まれたテキストを、1ページにつき1つのセクションで構成された単体のHTMLドキュメントに書き出します。テキストはエスケープされ、HTMLとして実行されません。元のフォント、画像、表、レイアウトは保持されません。OCRはありません。上限:入力10MiB、200ページ、出力4MiB。
制限事項と重要な注意点
入力は10MiB、200ページ、出力テキストは4MiBまでです。テキストレイヤーのないスキャン文書では、抽出に成功したように見せかけず、エラーが表示されます。読み順、段組み、フォントは見た目のレイアウトと一致しない場合があります。OCRでもPDFからWordへの変換でもありません。
例
テキストベースのレポートを書き出し、ダウンロードしたHTMLをローカルで開いてください。セクションはPDFのページ順に並びます。空白ページやスキャンされたページには、認識されたテキストとして黙って扱われず、その旨が表示されます。