你的文件会留在你的设备上

文件在你的浏览器中处理,不会上传到我们的服务器。网站可能会下载处理引擎,并发送不含文件内容的使用或反馈事件。

我们如何处理你的数据

PDF 转文本

把可搜索的报告 PDF 中的文本提取为 TXT,用于单独的评审、摘要或草稿。多栏页面的阅读顺序可能不同,请核对。

合成示例,运行前请检查操作设置。

你的文档会留在此设备上。工具下载和使用统计不包含文件内容。

本机限制: 单个文件的最大大小: 10 MB

文件在浏览器中处理,不会上传到本站。

实用指南

把报告的措辞带入文本评审

  1. 打开一个在查看器中可以选取文字的 PDF。
  2. 提取文本,并按源页面检查结果。
  3. 下载或复制文本,并对照 PDF 检查名称、数字和顺序。

试试这个示例

提取一份 5 页方案中的内嵌文字,在再次使用之前,把 TXT 输出中的报价和项目名称与渲染出的源文件对照。

之前

  • 可选中文本的 PDF

之后

  • 纯文本 .txt
此任务的输入和预期输出。 示意示例。

开始之前: 阅读顺序可能与多栏版面不同。这不是 OCR,也不是 Word 转换,不能替代目视检查。

继续处理源 PDF
获得的结果

把嵌入的文本提取为 TXT 文件。扫描页面需要 OCR;原文的阅读顺序可能与可视版面不同。

限制与重要说明

输入最大 10 MiB,最多 200 页,输出文本最大 4 MiB。没有文本层的扫描文档会报错,而不会假装提取成功。阅读顺序、分栏和字体可能与可视版面不一致。这不是 OCR,也不是 PDF 转 Word。

示例

从可搜索的报告中提取文本,在结果框中检查,然后复制或下载。提取文本之后,原始 PDF 仍然可用。