OCR文字识别
中文简体 + 英文
使用说明
基于 Tesseract.js(WASM)在浏览器本地识别。首次使用所选语言时需从 CDN 下载 对应训练数据(中文约 20MB,之后浏览器缓存),识别过程图片不上传到任何服务器。 清晰、正置、白底黑字的文档图效果最好;复杂表格建议专业工具。
基于 Tesseract.js(WASM)在浏览器本地识别。首次使用所选语言时需从 CDN 下载 对应训练数据(中文约 20MB,之后浏览器缓存),识别过程图片不上传到任何服务器。 清晰、正置、白底黑字的文档图效果最好;复杂表格建议专业工具。
图片文字识别(OCR)工具:从截图、扫描件、照片中提取可编辑文字,支持中英文混排,识别结果可直接复制。
最大因素是原图清晰度与文字对比度。截图类(屏幕直出)识别率很高;拍摄件注意光线均匀、文字端正、避免透视变形。
工整的手写体有较好支持,连笔、潦草字迹识别率会明显下降。印刷体场景效果最佳。