PocketPlay
EN

图片文字识别

在浏览器里用 Tesseract 识别截图和照片中的文字,支持中英日韩法德西等语言,图片不上传。

🔒 浏览器本地运行,文件不会上传免费 · 无需注册
把图片拖到这里 或点击选择 — 截图和光线均匀的平整照片识别效果最好

先添加一张图片。

识别语言

尽量只选需要的语言 — 多选一种就多下载一份数据、识别也更慢。语言包会从 Tesseract 官方 CDN 下载一次(每种 2–15 MB),之后由浏览器缓存。

识别结果

怎么从图片里提取文字

  1. 把截图或照片拖进上传框。画面清晰、正对镜头、对比度高的图片识别效果最好。
  2. 勾选图中出现的语言 — 只选英语最快。首次运行会下载一次 OCR 引擎(约 5 MB)和对应语言包(每种 2–15 MB),之后浏览器会缓存。
  3. 需要的话在图片上拖出一个矩形,只识别其中一段文字,然后点开始识别,最后复制或下载结果。

常见问题

图片会上传吗?

不会。识别在本标签页的 WebAssembly worker 里进行。唯一的网络请求是首次从 Tesseract 官方 CDN 下载引擎和语言包。

中文识别为什么不准?

中日韩文字比拉丁字母需要更大更干净的字形。截图前先放大、裁剪成单栏,并且只选简体或只选繁体,不要同时勾选。

能识别手写或 PDF 吗?

不能。Tesseract 针对印刷体训练,手写基本识别不了。PDF 请先导出成图片再来识别。