去年夏天,一套花了三十多万的视觉检测系统在产线上停摆了——误报率高到工人直接把摄像头给拔了。说实话,当时站在闷热的车间里,听着PLC的报警声,后背全湿透了。不是设备不行,是我们太相信实验室结果了。计算机视觉(CV)从demo到落地,中间隔着100个坑。
1. 硬件选型就是第一道坎
很多新手上来就撸代码,模型跑通就以为万事大吉——天真了。工业现场首先跟你较劲的是光照、震动、灰尘。你精心调好的参数,到了下午三点阳光斜射进窗户,全废。

我吃过最大的亏是镜头。普通CCTV镜头根本扛不住产线振动,焦点没几天就跑偏。后来换了工业FA镜头配锁紧螺丝,才消停。还有一次,为了省钱用面阵相机拍高速运动物体,图像拖影拖得连亲妈都不认识。✅经验:高速场景必须上全局快门,卷帘快门就是灾难。
光源更是个玄学。红色、蓝色、红外,什么角度、什么波长,试错成本巨高。有次测一个黑色橡胶件上的划痕,肉眼都难看清,普通环形光一打,表面油膜反光成一片白。最后用低角度暗场,划痕瞬间立体——当时差点跪下叫爸爸。
问:光源为什么能决定成败?
答:工业CV本质是“特征提取”,光源直接决定特征对比度。比如检测金属表面凹坑,同轴光能屏蔽表面反光,把缺陷凸显出来;要是用球积分光源,啥都看不见。光源一换,算法可能完全失效,这不是调调阈值能解决的。
2. 算法不是万能药,数据才是爹
模型选型?YOLO、ResNet、Transformer… 现在框架多得眼花缭乱,但真正卡脖子的是缺陷样本。产线上良率通常95%以上,想凑够几百张缺陷图?做梦。我们曾为了收集一种稀有焊渣缺陷,蹲守了两个月,只拿到23张有效图片。用这23张训练,模型过拟合到连背景上的水渍都当成焊渣。

问:小样本条件下怎么把模型训好?
答:数据增强是基本功,翻转旋转调亮度都是小儿科。更狠的是用GAN生成缺陷,或者把缺陷P到正常图上。我们试过一种方法:对少样本类别做过采样+强增强,同时引入行业预训练模型做迁移学习。有一次,靠13张缺陷图,把检出率干到96%,但前提是负样本足够干净。别信那些吹牛零样本的,实际场景复杂起来,人都认不准,何况模型。
标注也是个说不出的痛。外包团队能把“划痕”标成“裂纹”,让模型直接精神分裂。后来我们自研了标注工具,配合主动学习,先让模型挑不确定的图给人标,效率提升三倍。❗注意:标注完一定要做交叉验证,别问为什么,血泪教训。
3. 部署上线,才是真正的开始

实验室Python脚本跑得爽,部署到产线IPC上——帧率从30fps掉到3fps。客户脸都绿了。后来把模型量化、裁剪,用TensorRT部署到Jetson上,勉强恢复到20帧。💡边缘计算选型太重要,千万别高估工控机的算力,也别低估图像预处理的开销。
还有个隐形坑:通讯协议。视觉系统要跟PLC交互,结果我们软件只支持TCP,现场西门子PLC只认Profinet,当场宕机。现学现写协议转换模块,那两周每天都像在走钢丝。
最让我心有余悸的是环境适应性。有一年冬天,检测精度骤降,查了三天才发现是镜头热胀冷缩导致焦距微变。后来加了温控外壳,软件里也做了动态补偿。所以每次项目上线,我都在心里默念:别太信出厂参数,到了现场全是变量。
问:怎样才算一个成功的CV落地项目?
答:不是验收通过,而是连续30天无人工干预稳定运行。这需要从硬件选型、数据处理、算法鲁棒性到运维监控全链条考虑。尤其要设计好失效策略——检测失败时是停机还是报警?别让视觉系统成了产线瓶颈。✅我们现在的原则是:宁可拒收一千,绝不放过一个,但也要平衡误报率,否则工人迟早再拔摄像头。
写到这里,又想起那个拔掉摄像头的工人,黝黑的脸上挂着憨笑:“这东西,不如我眼睛好使。” 我说不出话。计算机视觉(CV)再厉害,最终还得过“人”这一关。你觉得呢?
免责声明:文章内容来自互联网,本站仅作为分享,不对其真实性负责,如有侵权等情况,请与本站联系删除。
转载请注明出处:计算机视觉(CV)落地工厂,我劝你先想清楚这几点 https://www.dachanpin.com/a/tg/66720.html