先定指标体系,再谈接入
把遥测分成「秒级高频」「分钟级常规」「事件级告警」三类,分别指定上报周期 100ms / 15s / 触发即传。避坑:不要所有点位统一 1s 上报,带宽与存储会被无意义消耗。
把 90% 的重复数据消灭在网关侧
网关内置流式算子,按 100ms 窗口做降采样与阈值过滤,仅上传变化量与统计值,上行带宽平均下降 72%。

发布订阅延迟稳定在毫秒区间
主题树按「区域/设备型/指标」三级编排,单集群支撑 120 万订阅关系,P99 推送延迟 46ms。

上线即鉴权,杜绝仿冒接入
基于硬件安全模块签发设备证书,双向 TLS 握手在 180ms 内完成,支持按批次吊销与灰度换证。

拖拽即生效,无需重启服务
可视化编排「条件—动作—通知」链路,规则热更新生效时间 ≤ 3 秒,单实例可并行执行 2000 条规则。

支持 Modbus / OPC-UA / 私有协议三种接入方式。协议已知时,网关侧配置约 0.5 人日/型号;协议未知需抓包解析,按 2 人日/型号估算。首批 50 台设备通常 3 个工作日内完成并网上线。
边缘采集 50ms + 总线路由 46ms + 时序库写入 120ms + 看板推送 200ms,端到端典型值约 480ms,P99 不超过 800ms。开启边缘预聚合后,看板刷新可稳定在 1 秒内。
不会。网关本地环形缓存默认保留 8 小时原始数据,断网期间按队列堆积,恢复后按时间戳补传并自动去重。若预估离线超 8 小时,可将缓存扩至 48 小时(占用约 12GB 本地存储)。
关键在于上行数据量:开启预聚合后单设备日均上行从 42MB 降至 11MB。按当前用量,10 万设备月流量成本可压缩约 70%,同时时序库存储量下降 60%,显著延缓扩容节奏。
把遥测分成「秒级高频」「分钟级常规」「事件级告警」三类,分别指定上报周期 100ms / 15s / 触发即传。避坑:不要所有点位统一 1s 上报,带宽与存储会被无意义消耗。
模拟量设置死区 ±0.5% FS,开关量去抖 200ms。实测可将无效上行消息削减 60% 以上,同时保留真实突变。
采用 区域/设备型/指标 三段式,如 east/plc-3/temp。避坑:禁止把设备序列号写进主题层级,否则订阅关系会随设备增长而爆炸。
预警档触发推送通知,告警档才下发控制动作,两档间隔建议 ≥ 10% 量程。避坑:单档阈值极易造成控制频繁抖动。
用 1 万台模拟设备压测总线,关注 P99 延迟与内存增长曲线。达标线:P99 < 100ms、单节点内存波动 < 8%。再线性放大到 10 万台。
首屏只保留 3 个核心指标 + 1 张趋势图,其余下沉二级页。刷新频率与数据周期对齐,避免 1s 刷新 15s 数据造成的视觉跳动。
重点盯离线率、补传成功率、规则命中率三项。健康线:离线率 < 1.5%、补传成功率 > 99%、规则误报 < 2 次/日,超标即回查去抖与阈值配置。
| 架构方案 | 端到端时延 | 10 万设备成本指数 | 适用场景 | 推荐度 |
|---|---|---|---|---|
| 直连云平台 | 300–600ms | 1.0(基准) | 设备分散、点位少、无本地联动需求 | — |
| 网关汇聚 + 云时序库 | 150–400ms | 0.65 | 工业园区、楼宇,点位密集且同网段 | 推荐 |
| 边缘预聚合 + 云总线 | 38–120ms | 0.42 | 高频采集、需本地快速联动控制的产线 | 最佳 |
| 全本地私有化 | < 20ms | 1.8 | 数据不出场、强合规要求的关键基础设施 | — |
原先产线异常要等到下一班次才被发现,接入数字星河后本地联动 200ms 内切断,单次异常损失明显下降。
异常响应 200ms1200 台计量表一周内全部并网,看板从搭建到上线只用两天,物联网解决方案的接入速度超出预期。
1200 台 / 5 天断网补传几乎没让我们操心,三个月内补传成功率始终保持在 99.6% 以上,数据完整性终于可控。
补传成功率 99.6%