level 8
中安未来12138
楼主

做OCR这么多年,我发现一个有意思的事:很多人觉得OCR就是扫身份证、扫发票,但实际上,汽车行业对OCR的需求比想象中大得多。前段时间跟一个做汽车金融的客户聊,他们每个月要处理几千辆二手车的信息录入。每辆车都要登记车牌号、车辆识别码(VIN码),以前全靠人眼对着照片一个字符一个字符敲。一辆车少说两三分钟,一天下来眼睛都花了。出错率还高——VIN码17位,O和0、I和1,看走眼一个,后面全乱套。
我们就针对这个场景做了两样东西:车牌识别和VIN码识别。
车牌识别这个大家比较熟悉,停车场、收费站、电子警察都在用。我们的方案核心优势是支持国内所有类型车牌——蓝牌、黄牌、新能源绿牌、警牌、军牌、领事馆牌、港澳两地牌,甚至泥污遮挡、角度倾斜、夜间逆光这些情况也做了专门优化。识别速度快到什么程度呢,基本上是摄像头捕捉到车牌的瞬间,文字结果就出来了。
VIN码识别可能很多人没听说过。VIN码就是车架号,每辆车独一无二的身份证,一般在挡风玻璃下方或者车门框上。这个识别难点在于:VIN码是刻在金属上的,反光严重;有些老车被腐蚀磨损了,字符残缺;拍摄角度刁钻,透视变形厉害。我们针对这些情况训练了专门的矫正模型,目前准确率能做到95%以上。
这两个东西组合在一起的应用场景还挺丰富的:
二手车交易平台:拍张照片自动录入车辆信息,不用手打
保险定损:事故现场快速采集车辆身份信息
4S店维修接待:扫一下车牌,车主信息、维修历史全出来了
车管所年检:自动比对车牌和VIN码是否一致
说实话,汽车行业是OCR应用的一个富矿。光国内机动车保有量就超过4亿辆,围绕车的信息采集、流转、核验,每个环节都能用上OCR。我们也在持续迭代模型,争取把VIN码在极端场景下的识别率再往上拉几个点。
如果你在汽车金融、二手车、保险理赔这些领域,对车牌或VIN码识别有需求,可以交流交流。