OCR 识别率翻倍指南:拍法、增强、复核一个不能少

同样的软件,有人识别率 95% 有人 60%:差在拍法和预处理。字高 20 像素是道坎,关键字段必须人工过一遍。
识别准不准,三样东西说了算
清晰度、字高、背景复杂度。正文字高低于 20 像素基本没救;扫描件按 300DPI 来;花底纹、水印、表格线都会干扰识别。源头不行,后面全白搭。
拍法:正对、光匀、字够大
手机拍文档:正对别倾斜(透视变形是识别杀手)、光线均匀避开反光阴影、离近点让字高够大(正文 20-30 像素往上)。拍糊了别指望软件救,重拍是正解。

预处理:先救再认
图不理想先做预处理:倾斜校正、对比增强、亮度拉平,有条件的做无损放大,再喂给 OCR。护照这种带防伪底纹的,亮度拉平后识别率明显上来。
复核:关键字段逐字过
识别完一键复制或导 TXT,但金额、日期、编号这类字段必须人工复核——0 和 O、1 和 l 错一个,代价都比识别费大。批量识别的结果,抽查关键字段是底线。
上手清单
- 拍文档:正对、光匀、字高 20 像素往上找不到这个入口,先把软件升到新版再看。
- 扫文档:300DPI 起步这步别图快跳过去,后面出问题多半是它。
- 识别前先校正倾斜、增强对比先拿一张无关紧要的图练手,别上来就动正式图。
- 识别完导 TXT 或复制,排版再手工整操作时盯着窗口里的提示走,别凭印象点。
- 金额日期编号,逐字人工复核效果能实时预览,不满意撤了重来就是。
最后唠叨两句
OCR 的准确率,七分在源头,两分在预处理,一分在软件。把拍图这件事做讲究了,识别率自然就上去了,别本末倒置。
过来人提醒
- 字高 20 像素是道坎
- 先校正增强再识别,顺序别反
- 金额日期编号,逐字人工复核
本文涉及:OCR、识别、文字、准确率、图片转文字(OCR 文档识别)。
