京公网安备 11010802034615号
经营许可证编号:京B2-20210330
连物联网数据都理不清楚还怎么搞大数据分析
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?本文旨在给你提供一些方法论和启示。
数据即价值是目前计算机领域极其推崇的观念。数据无论多少都被归结为大数据,数据分析越来越热门,资本也对贴有大数据标签的公司趋之若鹜。数据如同流动的数字货币一样被一再的评估、追崇。
当物联网在行业开始落地和应用后,由于其数据产生的速度之快,种类之多,体量之巨大都会对现有云端技术架构、数据处理方式带来超乎想象的压力和挑战。
面对如此复杂的数据,传说中的 “数据即价值”将被 “有价值的数据”这一理性的认识所打破。
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?
静态数据与动态数据
单从数据的变化上来说,物联网数据可以分为静态数据和动态数据,静态数据多为标签类,地址类数据,RFID产生的数据多为静态数据,静态数据多以结构性、关系型数据库存储;动态数据是以时间为序列的数据,物联网动态数据的特点是每个数据都与时间有一一对应关系,并且这种关系在数据处理中尤其重要,这类数据存储通常采用时序数据库方式存储。
静态数据会随着传感器的增多,控制设备数量的增多而增加;动态数据不仅随设备数量,传感器数量增加而增加,还会随时间的增加而增加。
无论静态数据还是动态数据,在物联网1.0阶段数据的增长是线性的,并非是指数级的,但是因为物联网动态数据是连续不间断的,因此数据的量也是海量的。因此物联网1.0阶段数据的压力是可控的,并不是如宣传的那样不可数,不可控。
能源类/资产属性类/诊断类/信号类
就数据的原始特性来说,我们可以把物联网数据分为能源类数据、资产属性类数据、诊断类数据、信号类数据。
能源类数据:是指可以能耗相关的,或者是计算能耗所需的相关数据例如电流、电压、功率因子、频率、谐波等等。能源数据是物联网最关键的数据类型,物联网最终的目的之一就是节能,那么获取能源数据,理解能源数据,分析能源数据是物联网实施中必须的功能。能源采集设备也是物联网重要的设备之一。
资产属性类数据:资产类数据通常指硬件资产数据比如设备的规格、参数等属性,设备的位置信息,设备之间的从属关系等等。资产类数据主要用于资产管理,资产管理是工业物联网非常重要的功能甚至可以作为独立的系统研究,因为它可以和ERP系统、MES系统、物流等几乎所有的系统对接。
诊断类数据:诊断类数据是指设备运行过程中检测设备运行状态的数据,诊断类数据可以有两类:一类为设备运行参数,例如设备输入/输出值,这里通常为传统工业自动化类数据即OT技术相关类数据;另外一类为设备外围诊断数据,例如设备的表面温度、设备噪音、设备震动等等,值得提出的是外围诊断才是物联网技术体现的地方它包括新型传感器技术和物联网通讯技术。外围诊断数据是预测性维护的重要的元数据,也为深度控制模型提供依据,因此诊断类数据是我们需要着重关注的数据类型。
信号类数据:信号类数据或者告警类数据是目前工业领域使用最普及的数据,因为其直观、易懂、关键,同时在本地、远程同时告知。信号类数据容易被忽略,但是它是物联网所需要的、也是快速可以采集到、并对物联网系统提供重要参考价值的数据之一。
数据之间的关联性
数据之间的关联性是不同数据之间的关系,数据之间的关系对了解整个系统的运行有着最直接的影响,数据之间的正确关系的梳理是系统有效运行,产生价值的基石。
数据之间的关联性可以从下面几个方面分析:
时间关联性:即同一时刻的数据照相,数据是同一时刻系统产生的,它反映的是系统这一时刻的状态,从数据世界角度看,这个系统就是这一时刻的数据集合。数据照相体现的是系统静态展示;时间戳是这类数据关键的因素,因此要求各个数据获取的时间戳必须相同,时间戳是目前很多数据所缺失的,也是物联网实施中需要关注和解决的问题之一。
流程关联性:即一个点的数据进过一定时间后影响第二个点数据的产生,它体现的是系统动态的流程展示。数据之间的流程关系性需要模型提供,并在实施中进行修正。
数据的时效性
数据的时效性是指数据产生到其被清除的时间,数据时效性是由系统的实施部署所决定。数据可以被使用多次也可以被使用一次后就可以被清除。总体来说远程部署数据还是边缘部署数据影响着数据的时效性,通常边缘部署的数据时效性短,远程数据的时效性长。边缘部署需要的数据通常及时性强,但是边缘存储空间,计算能力弱因此不能长期保存;远程数据通常为历史性数据展示、计算分析,同时云端空间、计算的伸缩性强,因此数据时效性长。
数据的实时性也是数据时效性的一部分,实时性和数据的部署位置,数据的重要性以及传输方式都有关联性。
以数据为中心的物联网设计方法论
总结物联网中的各类数据及特性或者抽象其通用性的目的是为了更好的选择不同的物联网技术进行快速、有效的实施。以数据为中心的物联网解决方案甚至商业模式将会是物联网的主流设计思想。
下文将从数据如何采集,数据如何预处理、数据如何传输等不同的角度进行分析如何应用物联网的各种技术。
以数据流向为核心的设计思路
从数据流向来设计包括:数据采集、数据汇聚、数据传输、数据持久化、数据展示、数据处理、数据矫正、数据消费。
以数据生产/消费的为核心的设计思路
生产/消费为核心的设计思路多以云端业务为中心,尤其整合现有各个分散子系统为目标或者产业链上下游的协同操作,物联网的数据多以关键数据指标类型为主或者为起始数据角色。
1)下面为供应链的数据流设计思路。
2)下面为综合管理系统设计
了解物联网数据是什么,并能够提出相应的物联网技术,掌握有价值的数据是物联网方案技术层面的第一步。同样也是物联网技术最终的具象单元——“有价值的数据”。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-06-10在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-06-08【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04