扫描件识别死活差那么几个字母 有没有能救命的组合拳

手上一堆扫描件要转文字,现在用的百度那套OCR,整体能看,但准确率就是上不去。老毛病两个:一些字母认不准,b和6、l和1这种经常串;偶尔还会抽风重复输出,同一行给你打两遍。

扫描件本身质量没得挑,三百dpi的正经件,不是手机怼着拍的糊图。

我在想是不是不该指望单个引擎硬扛。有没有那种万金油的流程,比如先做个二值化和去噪再喂进去,或者OCR出来的结果再拿模型过一遍纠错。就是不知道让模型纠错会不会更离谱,它可能顺手把不认识的词给我编成一个通顺的。有踩过坑的说说

重复输出多半是切块重叠了