从 PDF 中提取文本

把 PDF 里的文字取出来,做成可以搜索、粘贴或喂给别的工具的纯文本文件。没有排版,没有图片,只有按阅读顺序排好的文本。

1 · 选择文件

将 PDF 拖放到这里,或点击浏览

最多 5 个文件,每个不超过 50 MB

    提取工具读取 PDF 的文本层。没有文本层的扫描版 PDF(页面照片)几乎提取不出文本;本工具不执行 OCR。

    所有处理都通过开源 PDF 库在你自己的设备上进行,不会上传任何内容。

    3 · 获取文件

    结果会显示在这里。可以逐个下载,也可以打包成 ZIP 一起下载。

    从 PDF 中提取文本:分步指南

    1. 把文件拖入上方区域,或点击选择。
    2. 这一页需要的设置已经选好了。想要别的结果就自己改。
    3. 点击按钮。一切都在你的浏览器里进行,不会上传任何内容。
    4. 下载结果,或把多个文件打包成 ZIP 一起取走。

    常见问题

    扫描的文档也能用吗?

    只有当扫描件里已经带着生成它的软件留下的文本层时才行。一张单纯的页面照片没有可提取的文本,而这个工具不会从像素里认字。如果结果返回一片空白,那就是这种情况。

    文件会有哪些变化?

    只有你要求的那部分会变。文本仍然是文本,仍然可以选中;页面尺寸保持不变;也不会有任何内容被压平成图片。唯一的例外是压缩,它本来就是要改变文件的,页面上也写明了这一点。

    会上传任何内容吗?

    不会。PDF 引擎在你的浏览器里运行,文件在你自己的设备上读取,从不离开设备。没有账户,没有排队,也没有上传。

    真的免费吗?

    是的。无需注册,没有试用期,没有水印,处理多少文件也没有上限。网站靠广告维持运营。

    还能对 PDF 做的其他事

    还能转换的其他文件

    更多免费工具: 合并 · 拆分 · 旋转 · 压缩 · JPG 转 PDF · PDF 转 JPG · 提取文本