图片文字识别
在浏览器里用 Tesseract 识别截图和照片中的文字,支持中英日韩法德西等语言,图片不上传。
🔒 浏览器本地运行,文件不会上传免费 · 无需注册
把图片拖到这里
或点击选择 — 截图和光线均匀的平整照片识别效果最好
先添加一张图片。
在图片上拖出一个矩形,只识别框内的文字。
识别语言
尽量只选需要的语言 — 多选一种就多下载一份数据、识别也更慢。语言包会从 Tesseract 官方 CDN 下载一次(每种 2–15 MB),之后由浏览器缓存。
识别结果
怎么从图片里提取文字
- 把截图或照片拖进上传框。画面清晰、正对镜头、对比度高的图片识别效果最好。
- 勾选图中出现的语言 — 只选英语最快。首次运行会下载一次 OCR 引擎(约 5 MB)和对应语言包(每种 2–15 MB),之后浏览器会缓存。
- 需要的话在图片上拖出一个矩形,只识别其中一段文字,然后点开始识别,最后复制或下载结果。
常见问题
图片会上传吗?
不会。识别在本标签页的 WebAssembly worker 里进行。唯一的网络请求是首次从 Tesseract 官方 CDN 下载引擎和语言包。
中文识别为什么不准?
中日韩文字比拉丁字母需要更大更干净的字形。截图前先放大、裁剪成单栏,并且只选简体或只选繁体,不要同时勾选。
能识别手写或 PDF 吗?
不能。Tesseract 针对印刷体训练,手写基本识别不了。PDF 请先导出成图片再来识别。