PDF 提取文字
逐页提取 PDF 里的文字,可以直接复制,也可以保存成 .txt 文件。
🔒 浏览器本地运行,文件不会上传免费 · 无需注册
把 PDF 拖进来
也可以点击选择文件
提取结果
没有找到文字。这份 PDF 多半是扫描件,页面本身是图片,没有可复制的文字层。
怎么提取 PDF 里的文字
- 把 PDF 拖进来,文件不会上传,文字层由本地的 pdf.js 读取。
- 需要的话可以只提取部分页面(
1-3, 5, 8-),并选择是否标出分页位置。 - 点击提取文字,然后复制结果或保存成
.txt文件。
常见问题
为什么结果是空的?
因为这份 PDF 没有文字层。扫描件或拍照生成的 PDF 每一页都是图片,需要 OCR 识别,而不是文字提取。
为什么间距有点奇怪?
PDF 里的文字是按坐标摆放的碎片,而不是完整句子。工具会根据位置重建行,普通文档效果很好,但多栏排版和表格可能会错位。
中文、重音符号和表情能保留吗?
可以。文字按 Unicode 提取,.txt 以 UTF-8 编码保存,中日韩文字、带重音的字母和符号都不会丢。