你的文件会留在你的设备上

文件在你的浏览器中处理,不会上传到我们的服务器。网站可能会下载处理引擎,并发送不含文件内容的使用或反馈事件。

我们如何处理你的数据

PDF 转 CSV

把带可选中文本的报告 PDF 中的表格提取为 CSV 文件,一个表格一个文件,方便导入其他工具继续处理。 文件保留在浏览器中。

首次使用时需下载少量转换器文件。

PDF · 不超过 10 MiB、200 页。仅限文本型 PDF;不含 OCR。

检测到的表格

试试示例

下载示例文件

CSV 应包含四行三列,内容为项目、数量、金额以及总计 148.50。检测到多个表格时,会以 ZIP 压缩包形式下载多个 CSV 文件。

预期结果

适用于含嵌入文本且表格行规则的 PDF。扫描件需要先做 OCR。检测可能漏掉表格,或把文本放进错误的单元格;请将下载的文件与 PDF 对照检查。不会重建合并单元格和原有格式。

每个表格生成独立的 CSV 文件或 Excel 工作表。值保持为文本。可能被解释为公式的 CSV 值前会加上撇号;Excel 单元格明确存为文本。将 CSV 导入电子表格时,请选择文本列,以保留前导零和数字格式。

输入不超过 10 MiB、200 页、100 个表格、100,000 个单元格和 256 列,输出不超过 8 MiB。处理在 30 秒后停止。不规则的行会被拒绝,而不会被悄悄移位。

首次运行可能需要下载转换器文件,需要稍等片刻。如果失败,请检查网络连接,或尝试更小的文件。“取消”会停止正在进行的处理;之后可以重新选择文件再试。

引擎许可证和源代码

实用指南

把报告中的表格转入 CSV 文件

  1. 选择已有可选中文本的报告 PDF。
  2. 运行“PDF 转 CSV”,检测表格。
  3. 对照原报告,检查每个 CSV 的行和列。

试试这个示例

从一份报告 PDF 中提取 4 列 10 行的结果表;CSV 应重现全部 10 行,列顺序也一致。

开始之前: 扫描的报告页需要先做 OCR 才能提取;密集或含合并单元格的版式可能被错误检测或漏掉。