你的文件会留在你的设备上

文件在你的浏览器中处理,不会上传到我们的服务器。网站可能会下载处理引擎,并发送不含文件内容的使用或反馈事件。

我们如何处理你的数据
所有 PDF 工具

PDF 转文本

从可搜索的 PDF 中提取文本,得到可重复使用的纯文本副本。只包含现有的文字,不含字体、图片和扫描页。

合成示例,运行前请检查操作设置。

你的文档会留在此设备上。工具下载和使用统计不包含文件内容。

本机限制: 单个文件的最大大小: 10 MB

文件在浏览器中处理,不会上传到本站。

实用指南

取出文字,不转换页面设计

  1. 选择含有可选择文本的 PDF。
  2. 提取文本,并查看按页分隔的结果。
  3. 复制或下载 TXT,然后在 PDF 中核对重要的段落。

试试这个示例

从一份可搜索的 6 页会议资料中提取文本,分享 TXT 文件之前,把议程标题和行动事项与源文件核对。

之前

  • 可选中文本的 PDF

之后

  • 纯文本 .txt
此任务的输入与预期输出。 示意示例。

开始之前: 输出只有文本,没有原始字体、图片和版面;扫描页不会被识别。

继续处理源 PDF
获得的结果

把嵌入的文本提取为 TXT 文件。扫描页面需要 OCR;原文的阅读顺序可能与可视版面不同。

限制与重要说明

输入最大 10 MiB,最多 200 页,输出文本最大 4 MiB。没有文本层的扫描文档会报错,而不会假装提取成功。阅读顺序、分栏和字体可能与可视版面不一致。这不是 OCR,也不是 PDF 转 Word。

示例

从可搜索的报告中提取文本,在结果框中检查,然后复制或下载。提取文本之后,原始 PDF 仍然可用。