你的文件会留在你的设备上
文件在你的浏览器中处理,不会上传到我们的服务器。网站可能会下载处理引擎,并发送不含文件内容的使用或反馈事件。
我们如何处理你的数据PDF 转文本
从可搜索的 PDF 中提取文本,得到可重复使用的纯文本副本。只包含现有的文字,不含字体、图片和扫描页。
合成示例,运行前请检查操作设置。
你的文档会留在此设备上。工具下载和使用统计不包含文件内容。
本机限制: 单个文件的最大大小: 10 MB
文件在浏览器中处理,不会上传到本站。
实用指南
取出文字,不转换页面设计
- 选择含有可选择文本的 PDF。
- 提取文本,并查看按页分隔的结果。
- 复制或下载 TXT,然后在 PDF 中核对重要的段落。
试试这个示例
从一份可搜索的 6 页会议资料中提取文本,分享 TXT 文件之前,把议程标题和行动事项与源文件核对。
之前
- 可选中文本的 PDF
之后
- 纯文本 .txt
开始之前: 输出只有文本,没有原始字体、图片和版面;扫描页不会被识别。
继续处理源 PDF获得的结果
把嵌入的文本提取为 TXT 文件。扫描页面需要 OCR;原文的阅读顺序可能与可视版面不同。
限制与重要说明
输入最大 10 MiB,最多 200 页,输出文本最大 4 MiB。没有文本层的扫描文档会报错,而不会假装提取成功。阅读顺序、分栏和字体可能与可视版面不一致。这不是 OCR,也不是 PDF 转 Word。
示例
从可搜索的报告中提取文本,在结果框中检查,然后复制或下载。提取文本之后,原始 PDF 仍然可用。