PocketPlay
EN

PDF 提取文字

逐页提取 PDF 里的文字,可以直接复制,也可以保存成 .txt 文件。

🔒 浏览器本地运行,文件不会上传免费 · 无需注册
把 PDF 拖进来 也可以点击选择文件

怎么提取 PDF 里的文字

  1. 把 PDF 拖进来,文件不会上传,文字层由本地的 pdf.js 读取。
  2. 需要的话可以只提取部分页面(1-3, 5, 8-),并选择是否标出分页位置。
  3. 点击提取文字,然后复制结果或保存成 .txt 文件。

常见问题

为什么结果是空的?

因为这份 PDF 没有文字层。扫描件或拍照生成的 PDF 每一页都是图片,需要 OCR 识别,而不是文字提取。

为什么间距有点奇怪?

PDF 里的文字是按坐标摆放的碎片,而不是完整句子。工具会根据位置重建行,普通文档效果很好,但多栏排版和表格可能会错位。

中文、重音符号和表情能保留吗?

可以。文字按 Unicode 提取,.txt 以 UTF-8 编码保存,中日韩文字、带重音的字母和符号都不会丢。