本节摘要:云化不是把 SCADA 搬到云上,而是把「记忆与思考」交给云、把「反应」留在边缘。本节先划定云与边的职责红线,再讲多厂区系统的数据接入路径(语义自描述与状态管理),最后给出一条与第 7 章工程节奏衔接的三步渐进上云路线。
如果云化的动作只是「租一批云主机,把现在的服务器程序搬上去」,那得到的是更贵、更不受控的现系统。真正的云化是职责的重新分配:云做它擅长的(海量存储、弹性算力、跨域协同、模型训练),边做它必须做的(毫秒级闭环、断网自治、本地画面)。这条边界不是技术偏好,是物理定律与业务后果决定的——云侧的任何抖动都不允许威胁到泵的安全运行。记住这个出发点,再看具体的分工图与接入路径。
三类职责画了红线:安全联锁与紧急停机——响应确定性要求最高,永远在控制器本体(6.1 节已经讲过区域红线,这里是时间红线);本地闭环调节——恒压供水这类回路,断云必须照常工作;首屏操作能力——中控画面在本厂边缘服务器上运行,广域链路断了,值班员照常监视操作本厂。云侧承接的清单同样明确:历史数据的长周期归档与分析、跨厂区对比与集团报表、模型训练与策略生产、对外数据订阅服务。一句话记忆:边是系统的肌肉与脊髓,云是系统的记忆与智库——脊髓反射永远不经过大脑。

多厂区系统上云的第一道坎是「数据翻译」:每个厂各自的点表命名、报警语义、状态枚举都不一致,云侧应用写十个厂的适配逻辑会累死维护者。工程解法是接入层语义自描述:各厂边缘网关按统一机制(如 Sparkplug 及其等效物)发布数据——测点带名称、单位、类型元数据;状态用出生证书与死亡证书机制管理(发布方上线时广播全量、离线时订阅方即刻可知)。这样云侧应用面向的是一份自描述的数据空间,新厂接入即被看见,不需要云端逐厂开发。
配套两条纪律:质量标记一路随行——3.2 节的质检标记在云侧依然有效,分析模型要能区分「值是好是坏」;时标源端生成——4.2 节的硬要求在云链路上同样成立,云侧不做时标「改写」。
一步到位把在运系统改造云原生,风险与收益完全不成比例。务实的三步路线:
第一步:数据先上云。 只把历史数据外供到云端(走第 6 章 DMZ 管道),云侧建数据湖与集团报表。现场系统零改动,风险仅限于数据出口,收益立竿见影(跨厂对比、长期趋势)。这一步验收用 5.3 节的口径:云侧数据与厂侧历史库对账一致。
第二步:应用上云。 跨厂区应用(能耗对标、模型训练)在云上运行,产出以「策略或模型」形式经评估后下发边缘执行。下发机制必须带灰度与回退:新模型先影子运行(只算不动),与现场既有逻辑对比一段时间,达标后才切主,出问题一键回退。
第三步:能力下沉。 边缘侧逐步部署轻量推理(异常预警、仪表健康评分),云侧专注训练与评估。到这一步,云边协同才真正闭环——而第 7 章的验收方法论依旧适用:每项下沉能力都要有「不倒退」的对照验收。
数据上了云,云侧平台的设计有几条工控特色的讲究。时序存储选型:测点数据的写入是持续恒定的流,查询以时间窗口为主——时序数据库的写入吞吐与降采样能力是核心指标,通用关系库硬扛测点流的方案在点数上万后都会遇到瓶颈。语义层独立:点表语义、单位换算、状态枚举的翻译逻辑放在独立的数据服务层,应用层只见语义不见原始报文——这一层就是 8.1 节语义自描述的云端落点,它让「新增一个厂」对应用层透明。成本模型前置:云的成本随数据量线性增长,存储分层(热数据 SSD、温冷数据归档存储)、生命周期策略(明细保留期、聚合长期保留)、出口流量计费,三笔账在方案阶段就要算清——云上「先跑起来再说」的成本教训,通常在第一张账单到来时才被记住。
云侧平台与厂侧系统的职责接口也要成文:数据所有权(厂侧是数据生产者与第一权威,云侧是消费者与归档者)、断链时云侧应用的行为(显示数据截止时刻,不猜测不补插)、模型下发与边缘执行的责任边界(云侧训练与评估、边缘侧执行与熔断)。这些接口条款,是把互联网云平台的开发习惯翻译成工控可接受契约的关键——互联网的「快速迭代、容忍故障」与工控的「变更受控、故障定级」在同一平台上并存,靠的就是这些白纸黑字的接口约定。
渐进上云每一步都要有独立的验收口径,防止「云化」变成不可验收的连续动作。第一步数据上云:云侧数据与厂侧历史库做抽样对账(点抽两成、时段抽一个月),数值一致率与时标一致率达标为过;断链测试中云侧曲线的截止时刻准确(不补插、不猜测)。第二步应用上云:跨厂区应用的数据来源全部可追溯(每个指标能点开看到厂站源头);模型下发走影子运行期,与现场基线对比达标后才能切主,回退演练一次通过。第三步能力下沉:每项下沉功能带「不倒退」对照验收——报警漏报为零、误报不高于基线,边缘功能停用时系统完整回退到机制基线。三步口径的共同哲学:每一独立验收、每一步可回退,云化的收获要落成证据,而不是落成故事。
云边架构的验收清单里,有一项必须在真正依赖云之前完成:断云演练——人为断开云侧连接(拔线、断外网、限流到不可用),观察三件事:边缘侧闭环与画面是否无感继续(8.1 节红线条款的实测);云侧应用是否正确显示「数据截止时刻」而不是把旧数据当实时;恢复连接后,缓存数据是否按序补传、云侧统计是否恢复连续。演练记录进验收文件。上云项目最容易犯的错误是把「平时正常」当作「架构成立」——而云边架构的全部设计价值,恰恰体现在「不正常的那段时间里」边缘能撑多久、恢复得有多干净。断云演练之于云化系统,正如冗余切换演练之于双机系统:不演练的架构承诺一律不算数。
云化的本质是分工:记忆与思考上云,反应留边缘;不是机房外迁。
两条红线:安全联锁与本地闭环永不上云;断云时边缘全功能自治。
语义自描述:接入层用统一机制消除逐厂翻译,质量标记与时标一路随行。
三步渐进:数据上云、应用上云、能力下沉,每步独立验收、可回退。
数据到了云上,下一步是让数据「自己开口说话」——智能报警与边缘推理,下一节展开。