从 PDF 中提取文本
把 PDF 里的文字取出来,做成可以搜索、粘贴或喂给别的工具的纯文本文件。没有排版,没有图片,只有按阅读顺序排好的文本。
1 · 选择文件
将 PDF 拖放到这里,或点击浏览
最多 5 个文件,每个不超过 50 MB
提取工具读取 PDF 的文本层。没有文本层的扫描版 PDF(页面照片)几乎提取不出文本;本工具不执行 OCR。
所有处理都通过开源 PDF 库在你自己的设备上进行,不会上传任何内容。
3 · 获取文件
结果会显示在这里。可以逐个下载,也可以打包成 ZIP 一起下载。
从 PDF 中提取文本:分步指南
- 把文件拖入上方区域,或点击选择。
- 这一页需要的设置已经选好了。想要别的结果就自己改。
- 点击按钮。一切都在你的浏览器里进行,不会上传任何内容。
- 下载结果,或把多个文件打包成 ZIP 一起取走。
常见问题
扫描的文档也能用吗?
只有当扫描件里已经带着生成它的软件留下的文本层时才行。一张单纯的页面照片没有可提取的文本,而这个工具不会从像素里认字。如果结果返回一片空白,那就是这种情况。
文件会有哪些变化?
只有你要求的那部分会变。文本仍然是文本,仍然可以选中;页面尺寸保持不变;也不会有任何内容被压平成图片。唯一的例外是压缩,它本来就是要改变文件的,页面上也写明了这一点。
会上传任何内容吗?
不会。PDF 引擎在你的浏览器里运行,文件在你自己的设备上读取,从不离开设备。没有账户,没有排队,也没有上传。
真的免费吗?
是的。无需注册,没有试用期,没有水印,处理多少文件也没有上限。网站靠广告维持运营。