图片文字识别 (OCR)
文本用 Tesseract.js 从图片提取文字,支持 60+ 种语言(含中英日),本地识别不上传,适合扫描件数字化、截图取字与多语言 OCR,适合文本清洗、格式转换与内容规范化,浏览器本地处理,数据不上传,免费即开即用。
拖入图片或点击上传
相关工具
关于 图片文字识别 (OCR)
图片 OCR 文字识别工具基于 Tesseract.js 引擎在浏览器本地从图片中提取文字。Tesseract.js 是 Google Tesseract OCR 引擎的 WebAssembly 移植版本,支持 60 余种语言(含简体中文、繁体中文、英文、日文、韩文等),语言数据包按需从 CDN 加载后缓存到浏览器 IndexedDB。识别过程使用 LSTM 神经网络模型对图像进行文本行检测、字符分割和语义推理,支持输出置信度分数和字符级坐标边界框。可处理截图、扫描件、照片等多种图片来源。需要说明的是,OCR 的准确率高度依赖输入质量:清晰、端正、高对比度的印刷体截图准确率可到 90% 以上,而倾斜、光照不均或带水印的反光照片会明显掉点;中文字符集庞大,识别个别错字属正常现象,建议对关键字段人工复核。所有识别在浏览器本地通过 WebAssembly 完成,图片不上传服务器,可放心处理含敏感信息的文档。首次使用某语言需加载语言包,之后会缓存到本地,后续识别会快很多。
使用方法
- 打开 图片文字识别 (OCR) 工具页面
- 根据需求输入或粘贴数据到输入区域
- 查看实时处理结果,使用复制按钮获取输出
使用场景
- 截图文字提取 — 从软件界面截图中提取按钮文字或错误信息,便于搜索解决方案或记录问题。
- 扫描件数字化 — 将纸质文档的扫描件图片转为可编辑文本,替代手动录入提高效率。
- 证件信息读取 — 从身份证、护照等证件照片中提取文字信息,用于表单自动填充后仍需人工核对。
- 图片翻译前置 — 从外文图片中提取文字后粘贴到翻译工具,实现图片内容翻译。
- 表格图片转文本 — 从表格截图或照片中提取文字内容,转为可编辑的纯文本数据到手整理。
常见问题
支持哪些语言?
支持 60 余种语言,包括简体中文、繁体中文、英文、日文、韩文、法文、德文等。语言数据包按需从 CDN 加载并缓存到本地。
识别准确率怎么样?
清晰截图和扫描件的准确率可达 90% 以上。照片受光线、角度和模糊度影响准确率会下降。建议使用高分辨率、光线均匀的图片。
中英文混合能识别吗?
可以同时勾选中文与英文语言包进行混合识别。个别生僻字或连笔字可能出错,关键信息建议复制后人工复核一遍。
首次使用加载较慢正常吗?
正常。首次使用某语言时需从 CDN 下载语言数据包(约 10 至 15MB),加载后缓存到 IndexedDB,后续使用无需重复下载。
能识别手写字体吗?
识别手写文字的准确率较低,Tesseract 引擎主要针对印刷体优化。手写体建议使用专门的笔迹识别工具。
图片会被上传吗?
不会。所有 OCR 识别在浏览器本地通过 Tesseract.js 的 WebAssembly 引擎完成,图片不离开你的设备,可安全处理含敏感信息的证件和文档。
评论与讨论
评论仅保存在你的浏览器本地,切换设备后不可见。配置 Giscus 后可支持云端评论。