图片文字识别 (OCR)

文本

使用 Tesseract.js 从图片中提取文字,支持 60+ 种语言(含中文、英文、日文)。100% 客户端识别,文件不上传,适合扫描件数字化、截图文字提取与多语言 OCR 识别场景。

拖入图片或点击上传

未选择文件

关于 图片文字识别 (OCR)

图片 OCR 文字识别工具基于 Tesseract.js 引擎在浏览器本地从图片中提取文字。Tesseract.js 是 Google Tesseract OCR 引擎的 WebAssembly 移植版本,支持 60 余种语言(含简体中文、繁体中文、英文、日文、韩文等),语言数据包按需从 CDN 加载后缓存到浏览器 IndexedDB。识别过程使用 LSTM 神经网络模型对图像进行文本行检测、字符分割和语义推理,支持输出置信度分数和字符级坐标边界框。可处理截图、扫描件、照片等多种图片来源。建议收藏本工具以便日常快速使用。所有识别在浏览器本地通过 WebAssembly 完成,图片不上传服务器,可放心处理含敏感信息的文档。所有计算均在浏览器本地完成,数据不上传,可放心操作。

使用方法

  1. 打开 图片文字识别 (OCR) 工具页面
  2. 根据需求输入或粘贴数据到输入区域
  3. 查看实时处理结果,使用复制按钮获取输出

使用场景

  • 截图文字提取 — 从软件界面截图中提取按钮文字或错误信息,便于搜索解决方案或记录问题。
  • 扫描件数字化 — 将纸质文档的扫描件图片转为可编辑文本,替代手动录入提高效率。
  • 证件信息读取 — 从身份证、护照等证件照片中提取文字信息,用于表单自动填充。
  • 图片翻译前置 — 从外文图片中提取文字后粘贴到翻译工具,实现图片内容翻译。
  • 表格图片转文本 — 从表格截图或照片中提取文字内容,转为可编辑的纯文本数据。

常见问题

支持哪些语言?

支持 60 余种语言,包括简体中文、繁体中文、英文、日文、韩文、法文、德文等。语言数据包按需从 CDN 加载并缓存到本地。

识别准确率怎么样?

清晰截图和扫描件的准确率可达 90% 以上。照片受光线、角度和模糊度影响准确率会下降。建议使用高分辨率、光线均匀的图片。

首次使用加载较慢正常吗?

正常。首次使用某语言时需从 CDN 下载语言数据包(约 10 至 15MB),加载后缓存到 IndexedDB,后续使用无需重复下载。

能识别手写字体吗?

识别手写文字的准确率较低,Tesseract 引擎主要针对印刷体优化。手写体建议使用专门的笔迹识别工具。

图片会被上传吗?

不会。所有 OCR 识别在浏览器本地通过 Tesseract.js 的 WebAssembly 引擎完成,图片不离开你的设备,可安全处理含敏感信息的证件和文档。

广告

评论与讨论

还没有评论,来抢沙发吧!

评论仅保存在你的浏览器本地,切换设备后不可见。配置 Giscus 后可支持云端评论。