文档与 PDF
PDF 转文本
按页面顺序逐页提取 PDF 文档中的文字,保存为一个 TXT 文件。
转换工作区
PDF 转文本
按页面顺序逐页提取 PDF 文档中的文字,保存为一个 TXT 文件。
正在检查浏览器支持
开始前正在确认文件选择和下载功能是否可用。
使用方法
选择 PDF
选择一个包含文字、不超过 50 MiB 的 PDF 文件。
开始提取
文件检查完成后开始提取文字。
保存 TXT
下载生成的 TXT 文件。
常见问题
可以从扫描版 PDF 中提取文字吗?
不可以。扫描版 PDF 只包含页面的图片,没有可提取的文字层。不支持光学字符识别(OCR)。
为什么换行和原文档不一样?
PDF 只存储每个字符的位置,不存储段落结构。行是根据位置数据重新构建的,因此表格和多栏排版的顺序和换行可能与原文档不同。
多个页面如何保存?
所有页面的文字会按页面顺序拼接,保存为一个 TXT 文件。
支持非英文的 PDF 吗?
支持。提取的文本以 UTF-8 保存,可支持包括中文在内的大多数语言。不过部分特殊字体可能无法正确提取。
我的 PDF 会被上传到别处吗?
不会。文件不会离开你的设备。提取全程在浏览器中进行,不会上传任何内容。