试卷/习题上的外文内容,OCR认不认?

中英混排可以一次识别,结果按语种分段出。手写和公式识别弱,印刷正文较稳。混排文档盯两点:英文单词别被拆成单个字母(原图字距太宽会这样,先收一收),专业术语和缩写识别完人工过一遍。新版本入口可能挪了位置,找不到就先更新。
这事是怎么一回事
试卷/习题上的外文内容,OCR认不认?OCR 说到底是模式识别:把图里的字形匹配成文字。识别率看三样:图片清晰度、文字排版、语言种类。印刷体、横排、高分辨率,主流引擎准确率都很高;手写、歪斜、模糊,就得放低预期。
本文按公开资料整理,版本更新后界面可能微调,但思路不变。
上手这么办
- 中英混排可一次识别操作时盯着窗口里的提示走,别凭印象点。
- 字距太宽英文会被拆字母先拿一张无关紧要的图练手,别上来就动正式图。
- 术语缩写人工复核这步别图快跳过去,后面出问题多半是它。

过来人提醒
- 识别结果别直接用,从头到尾过一遍再交付
- 识别前先把无关区域裁掉,干扰少了准确率立马上来
- 表格识别完重点对数字列,错位漏格是最常见的坑
本文涉及:试卷/习题 识别、试卷/习题 OCR、图片转文字(试卷/习题 识别)。
同类问题:试卷/习题分辨率低,OCR还有救吗?
这坑我踩过,字小模糊的图先救再认:用增强功能拉高清晰度和对比,有条件的做无损放大,让正文字高够到 20 像素以上再喂 OCR。手写和公式识别弱,印刷正文较稳。原图实在救不动的,重新拍、重新扫是唯一正解。涉及像素、体积、底色的硬指标,一律以报名系统或平台当前公告为准。
这事是怎么一回事
赶时间直接看第二节步骤;想弄明白原理,第一节值得读一遍。
这类问题没有一键解,但按步骤排查,绝大多数十分钟内收工。
上手这么办
- 先增强放大再识别到这一步基本成型,剩下的就是微调。
- 字高 20 像素是道坎批量的话这步对所有选中图生效,先抽查再跑全量。
- 救不动就重拍重扫参数别死记,按参考值设完看效果再调。

过来人提醒
- 表格识别完重点对数字列,错位漏格是最常见的坑
- 竖排、手写目前识别率都不理想,重要内容老老实实人工录
- 扫描或拍照奔着 300DPI 去,字太小先放大再识别
本文涉及:试卷/习题 识别、试卷/习题 OCR、图片转文字(试卷/习题 识别)。
