摘要:本文结合近五年在十多家不同规模制造工厂落地物联项目的经验,拆解工厂物联数据底座支撑平台的设计核心矛盾,分享实际选型、架构设计中的避坑要点,适合有一定基础准备落地项目的工程师参考。
为什么你做的物联平台最后成了数据垃圾场?
很多工厂上物联项目,一开始的思路都是找供应商做看板,做可视化,领导一眼能看到所有设备的开机率,皆大欢喜。过了半年,要做质量追溯,要做预测性维护,要把设备数据和工单数据打通,才发现不对——所有数据都散在各个模块里,格式不对,对不上,拿不出来。
我们去年给长三角一家做汽车冲压件的工厂做改造,他们三年前花了近两百万上线的物联系统,就是这种情况。不同车间的设备数据分别存在不同供应商的系统里,打通一次数据要找三家供应商开接口,光接口费就又花了几十万。
说白了,根子上就错了。没搭对数据底座,上层应用都是空中楼阁。

很多中小型工厂的物联项目,预算就那么多,大家都把钱花在好看的前端看板上,留给底座的钱和精力少得可怜。到最后,存了一堆格式混乱的原始数据,用的时候拿不出来,成了占空间的垃圾。谁做谁知道。
核心设计:底座必须接住三类核心冲突
做工厂物联数据底座支撑平台,核心不是堆技术,是解决工厂里实际存在的各种矛盾。我做了这么多项目,总结下来,只要把三个冲突解决好,底座就不会出大问题。
第一个冲突,是新旧设备的协议冲突。你随便进一个投产五年以上的工厂看看,有2000年买的老数控车,只有RS232串口输出,有2010年买的国产注塑机,带的是厂商私有协议,有最新买的六轴机器人,原生支持OPC UA,还有一堆传感器用的Modbus。要是底座没做分层的协议接入设计,加一个新设备就得改一次代码,不到一年维护就能把团队拖死。
我们现在的标准做法是,协议解析层做容器化隔离,每一类协议做成一个独立的微服务,接入新设备直接加镜像,不需要改核心代码。所有解析出来的数据,统一按照GB/T 40671-2021《智能制造 系统集成要求》做格式对齐,字段命名统一规则,不会出来好几个“转速”字段对不上号。实测下来,单台四核边缘节点,最多可以同时跑128路不同协议解析,CPU占用稳定在40%以内,完全满足绝大多数工厂的需求。
第二个冲突,是实时数据和离线存储的成本冲突。很多选型的新手,要么全把数据存关系型数据库,查高频数据慢得要死,要么全存时序数据库,存储成本高到离谱。之前有个项目,工程师图省事,把所有100Hz采样的振动数据全存在SSD云上,三个月不到存储费用超了预算三倍,老板脸都绿了。
我们现在的分层存储方案很成熟:1秒以内的高频工艺数据、实时工况数据存时序库InfluxDB,按1小时分桶,查询速度比不分桶快8倍;设备基础信息、工单告警、质量数据存关系型数据库;三个月前的冷数据自动归档到对象存储,访问频率低,成本只有全存SSD的1/15,兼顾了速度和成本。
第三个冲突,是多业务对接的需求冲突。上游质量部门要数据做不良分析,下游设备部门要数据做预测维护,财务要数据做OEE核算,每个部门要的数据格式都不一样。底座如果直接把原始数据甩出去,每个部门自己洗数据,最后出来的指标都对不上,吵不完的架。所以我们一定要在底座里做一层统一的数据标准层,把所有数据清洗打标完再输出给上层业务,从根源上避免数据口径不一致的问题。

落地避坑:这些错我已经帮你踩过了

说实话,很多项目折不是因为技术不行,是选型和设计走偏了。说几个我踩过的坑,你别再跳。
第一个坑,盲目全上云。很多云厂商的销售把全云架构吹得天花乱坠,你要是真信了,把500台设备的实时数据全传上去,一年带宽费用几十万都打不住,万一工厂网络断几个小时,本地连设备状态都看不了,出了问题谁担责?我们现在都是做边缘-云协同的底座架构,边缘节点存7天以内的实时数据,本地控制完全不依赖外网,只把统计数据、异常告警数据传上去,一年带宽成本能降到原来的十分之一都不到,网络断了也不影响本地用。
第二个坑,过度设计追求大而全。一开始就要做支持一万台设备的分布式架构,说要留足扩展空间,可绝大多数中小型工厂,全厂加起来都不到200台设备,过度设计下来,光运维就要两个人全职盯着,项目验收完老板嫌养不起人,直接就把平台放那落灰了。我们现在做的底座都是模块化的,一开始接入100台设备,只要2核8G的资源就能跑起来,后续加设备再加节点,弹性扩展,一点不浪费。
第三个坑,忽略前置数据质量校验。很多人觉得设备传什么我就存什么,不就是个底座吗?去年给一家热轧板厂做项目,他们之前的底座就没做校验,一个轧机的温度传感器坏了,连续一周传1200度的异常值,实际正常工作温度才500度,没人发现,最后训练出来的质量预测模型结果全错,返工花了两周,差点耽误项目验收。所以底座一定要加前置数据校验,范围校验、突变校验、空值校验一个都不能少,异常数据直接打标隔离,绝对不能让垃圾数据进主库。这是底线。
工厂做物联,本质是用数据降本增效,不是做样子给领导看。只要底座扎稳了,后面加什么应用都快,要是底座歪了,花再多钱做上层应用都是白搭。
毕竟,能撑住业务持续迭代的底座,才是真的能用的工厂物联数据底座支撑平台。