端侧 OCR · WebAssembly

从图片提取文字 就在浏览器中。

Tesseract OCR,完全端侧运行。上传图片或粘贴截图 — 支持 100+ 语言,零上传。

100+ 语言
词级定位框
100% 隐私
为何选择 OCR

精准文字识别。零上传。

Tesseract.js 在浏览器本地运行 — 无服务器、无 API 密钥、无限制。

100% 隐私

图片永不离开你的设备。所有识别通过 WebAssembly 本地完成。

100+ 语言

英文、中文、日文、韩文及主要欧洲语种 — 随时切换。

词级定位框

每个识别出的词都带边界框与置信度,叠加显示在图片上。

随处导出

复制纯文本,或下载为 TXT、JSON(含坐标)、可搜索的 hOCR。

工作原理

三步完成。零服务器。

  1. 01

    上传或粘贴

    拖放图片、粘贴截图或浏览选择。支持 PNG、JPG、WebP、BMP、GIF。

  2. 02

    本地识别

    Tesseract 通过 WebAssembly 在浏览器中识别文字,附带词位置与置信度。

  3. 03

    复制或导出

    复制文本或下载为 TXT、JSON、hOCR。引擎缓存以供复用。

完整指南

关于 OCR 文字识别工具

一个免费的 OCR 工具,在你的浏览器里从图片和文档中提取文字——截图、白板照片、扫描页、证书和手写印刷体笔记。它是为那些不愿把敏感文档上传到在线转换服务的人而设计的。

工作原理

该工具运行 Tesseract.js——把开源 Tesseract OCR 引擎编译成 WebAssembly——完全在客户端完成。60 多种语言的数据按需下载,并在首次使用后缓存,其中包括中文、英文、日文和韩文的识别包。图片会先在浏览器内做预处理(灰度、对比度、倾斜校正提示),然后逐行识别。结果是可选中、可复制的文本,并能导出为 .txt 文件。

限制与要求

识别质量取决于源图质量:清晰、光照均匀、拍摄端正的图片几乎能输出完全正确的文本;模糊的拍摄角度或装饰性字体会需要人工校对。首次使用某种新语言时需要下载对应的训练数据。大批量处理没有问题,但受限于设备内存;在可用时 WebGPU 加速会有所帮助。

隐私

合同、证件或私人信件的截图与扫描件都留在你的设备上。识别过程不会上传任何内容——对于你不会放心交给随便一个转换网站的文档,这个区别很重要。

问题,已解答。

不会。所有操作都在你的浏览器中完成。Tesseract OCR 通过 WebAssembly 在本地运行 — 你的图片永远不会离开你的设备。