长风破浪会有时,直挂云帆济沧海。 —— 李白《行路难》

图片文字在线识别 - OCR提取图片中的文字

OCR 文字识别(中英文)

图片文字识别说明

上传图片后点击识别,支持中英文混合文字。首次使用需加载语言模型(中文约25MB),请耐心等待。所有处理在浏览器本地完成,图片不上传服务器。如果图片里包含二维码,可继续使用二维码识别提取内容。

OCR 识别的应用场景

截图文字提取:从聊天记录、网页截图中提取文字直接复用;扫描件数字化:将纸质文档拍照后识别为可编辑文本;PDF 图片处理:从 PDF 截图或扫描件中提取文字存档;外语辅助:识别外文图片中的文字进行翻译或学习。

常见问题

OCR 识别准确率如何?

识别准确率取决于图片清晰度和文字排版。清晰扫描件和截图准确率较高(90% 以上),模糊图片或手写体准确率会降低。建议使用高清晰度图片。

首次加载为什么比较慢?

首次使用需下载 Tesseract 语言模型(中文约 25MB),加载后后续识别速度较快。模型下载进度会实时显示在页面上。

图片会被上传到服务器吗?

不会。OCR 识别完全在浏览器本地通过 Tesseract.js 完成,图片数据不会离开您的设备。

支持哪些语言?

支持中文简体、英文以及中英文混合识别。可在语言选项中选择相应模型。