逐页提取文本到可下载的文本文件。没有文本层的扫描 PDF 几乎提取不到文字。
如何从 PDF 提取文本
- 把 PDF 添加到面板。
- 点击按钮提取文本。
- 下载包含每一页文本的 .txt 文件。
什么时候需要把 PDF 转成文本
提取文本是拿到 PDF 文字内容的第一步:摘抄引用不用重新打字、在任何编辑器里搜索文档、或把内容交给其他工具处理。
输出是按页顺序排列的纯文本 .txt 文件,可以直接粘贴到任何地方使用。
注意纯图像扫描件没有可提取的文字层,需要先用 OCR 才能转成文本。
为什么在浏览器里提取 PDF 文本
提取在设备本地完成,文档不会被上传。对合同、草稿等不想放到服务器上的文字内容来说,这一点很重要。
输出是干净的纯文本,任何编辑器都能打开,方便二次加工。
免费、无需注册,任何浏览器都能用。PDF Shrink iPhone 应用在离线时提供同样的本地工具。
常见问题
对扫描 PDF 有效吗?
仅当扫描件带有文本层时有效。纯图像扫描没有可提取文字,需要先做 OCR。
输出是什么格式?
按页顺序排列的纯文本 .txt 文件。
原文件会被改动吗?
不会。PDF 只会被读取,文本写入新文件。
文档会被上传吗?
不会。一切都在浏览器里运行。
提取的文本保留格式吗?
输出是纯文本,不保留字体、颜色或版式,适合需要文字内容本身的场景。