从图片提取文字 就在浏览器中。
Tesseract OCR,完全端侧运行。上传图片或粘贴截图 — 支持 100+ 语言,零上传。
精准文字识别。零上传。
Tesseract.js 在浏览器本地运行 — 无服务器、无 API 密钥、无限制。
100% 隐私
图片永不离开你的设备。所有识别通过 WebAssembly 本地完成。
100+ 语言
英文、中文、日文、韩文及主要欧洲语种 — 随时切换。
词级定位框
每个识别出的词都带边界框与置信度,叠加显示在图片上。
随处导出
复制纯文本,或下载为 TXT、JSON(含坐标)、可搜索的 hOCR。
三步完成。零服务器。
- 01
上传或粘贴
拖放图片、粘贴截图或浏览选择。支持 PNG、JPG、WebP、BMP、GIF。
- 02
本地识别
Tesseract 通过 WebAssembly 在浏览器中识别文字,附带词位置与置信度。
- 03
复制或导出
复制文本或下载为 TXT、JSON、hOCR。引擎缓存以供复用。
关于 OCR 文字识别工具
一个免费的 OCR 工具,在你的浏览器里从图片和文档中提取文字——截图、白板照片、扫描页、证书和手写印刷体笔记。它是为那些不愿把敏感文档上传到在线转换服务的人而设计的。
工作原理
该工具运行 Tesseract.js——把开源 Tesseract OCR 引擎编译成 WebAssembly——完全在客户端完成。60 多种语言的数据按需下载,并在首次使用后缓存,其中包括中文、英文、日文和韩文的识别包。图片会先在浏览器内做预处理(灰度、对比度、倾斜校正提示),然后逐行识别。结果是可选中、可复制的文本,并能导出为 .txt 文件。
限制与要求
识别质量取决于源图质量:清晰、光照均匀、拍摄端正的图片几乎能输出完全正确的文本;模糊的拍摄角度或装饰性字体会需要人工校对。首次使用某种新语言时需要下载对应的训练数据。大批量处理没有问题,但受限于设备内存;在可用时 WebGPU 加速会有所帮助。
隐私
合同、证件或私人信件的截图与扫描件都留在你的设备上。识别过程不会上传任何内容——对于你不会放心交给随便一个转换网站的文档,这个区别很重要。