你的文件会留在你的设备上

文件在你的浏览器中处理,不会上传到我们的服务器。网站可能会下载处理引擎,并发送不含文件内容的使用或反馈事件。

我们如何处理你的数据

PDF 转 CSV

把带可选中文本的 PDF 中的表格提取为 CSV 文件,一个表格一个文件。扫描页需要先做 OCR 才能提取。 文件保留在浏览器中。

首次使用时需下载少量转换器文件。

PDF · 不超过 10 MiB、200 页。仅限文本型 PDF;不含 OCR。

检测到的表格

试试示例

下载示例文件

CSV 应包含四行三列,内容为项目、数量、金额以及总计 148.50。检测到多个表格时,会以 ZIP 压缩包形式下载多个 CSV 文件。

预期结果

适用于含嵌入文本且表格行规则的 PDF。扫描件需要先做 OCR。检测可能漏掉表格,或把文本放进错误的单元格;请将下载的文件与 PDF 对照检查。不会重建合并单元格和原有格式。

每个表格生成独立的 CSV 文件或 Excel 工作表。值保持为文本。可能被解释为公式的 CSV 值前会加上撇号;Excel 单元格明确存为文本。将 CSV 导入电子表格时,请选择文本列,以保留前导零和数字格式。

输入不超过 10 MiB、200 页、100 个表格、100,000 个单元格和 256 列,输出不超过 8 MiB。处理在 30 秒后停止。不规则的行会被拒绝,而不会被悄悄移位。

首次运行可能需要下载转换器文件,需要稍等片刻。如果失败,请检查网络连接,或尝试更小的文件。“取消”会停止正在进行的处理;之后可以重新选择文件再试。

引擎许可证和源代码

实用指南

检测到表格,创建 CSV

  1. 选择带可选中文本的 PDF。
  2. 运行“PDF 转 CSV”。
  3. 对照源表格,检查每个 CSV 的行和列。

试试这个示例

从 PDF 中提取一个 3 列 8 行的表格;CSV 应包含同样的 8 行 3 列。

开始之前: 检测可能漏掉复杂或无边框的表格;扫描页在先做 OCR 之前不会产生结果。