京公网安备 11010802034615号
经营许可证编号:京B2-20210330
连物联网数据都理不清楚还怎么搞大数据分析
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?本文旨在给你提供一些方法论和启示。
数据即价值是目前计算机领域极其推崇的观念。数据无论多少都被归结为大数据,数据分析越来越热门,资本也对贴有大数据标签的公司趋之若鹜。数据如同流动的数字货币一样被一再的评估、追崇。
当物联网在行业开始落地和应用后,由于其数据产生的速度之快,种类之多,体量之巨大都会对现有云端技术架构、数据处理方式带来超乎想象的压力和挑战。
面对如此复杂的数据,传说中的 “数据即价值”将被 “有价值的数据”这一理性的认识所打破。
物联网的数据有哪些特点?有没有合理化的分类方式?我们有没有应对物联网数据带来的压力和挑战的能力?物联网1.0阶段有价值的数据有哪些?
静态数据与动态数据
单从数据的变化上来说,物联网数据可以分为静态数据和动态数据,静态数据多为标签类,地址类数据,RFID产生的数据多为静态数据,静态数据多以结构性、关系型数据库存储;动态数据是以时间为序列的数据,物联网动态数据的特点是每个数据都与时间有一一对应关系,并且这种关系在数据处理中尤其重要,这类数据存储通常采用时序数据库方式存储。
静态数据会随着传感器的增多,控制设备数量的增多而增加;动态数据不仅随设备数量,传感器数量增加而增加,还会随时间的增加而增加。
无论静态数据还是动态数据,在物联网1.0阶段数据的增长是线性的,并非是指数级的,但是因为物联网动态数据是连续不间断的,因此数据的量也是海量的。因此物联网1.0阶段数据的压力是可控的,并不是如宣传的那样不可数,不可控。
能源类/资产属性类/诊断类/信号类
就数据的原始特性来说,我们可以把物联网数据分为能源类数据、资产属性类数据、诊断类数据、信号类数据。
能源类数据:是指可以能耗相关的,或者是计算能耗所需的相关数据例如电流、电压、功率因子、频率、谐波等等。能源数据是物联网最关键的数据类型,物联网最终的目的之一就是节能,那么获取能源数据,理解能源数据,分析能源数据是物联网实施中必须的功能。能源采集设备也是物联网重要的设备之一。
资产属性类数据:资产类数据通常指硬件资产数据比如设备的规格、参数等属性,设备的位置信息,设备之间的从属关系等等。资产类数据主要用于资产管理,资产管理是工业物联网非常重要的功能甚至可以作为独立的系统研究,因为它可以和ERP系统、MES系统、物流等几乎所有的系统对接。
诊断类数据:诊断类数据是指设备运行过程中检测设备运行状态的数据,诊断类数据可以有两类:一类为设备运行参数,例如设备输入/输出值,这里通常为传统工业自动化类数据即OT技术相关类数据;另外一类为设备外围诊断数据,例如设备的表面温度、设备噪音、设备震动等等,值得提出的是外围诊断才是物联网技术体现的地方它包括新型传感器技术和物联网通讯技术。外围诊断数据是预测性维护的重要的元数据,也为深度控制模型提供依据,因此诊断类数据是我们需要着重关注的数据类型。
信号类数据:信号类数据或者告警类数据是目前工业领域使用最普及的数据,因为其直观、易懂、关键,同时在本地、远程同时告知。信号类数据容易被忽略,但是它是物联网所需要的、也是快速可以采集到、并对物联网系统提供重要参考价值的数据之一。
数据之间的关联性
数据之间的关联性是不同数据之间的关系,数据之间的关系对了解整个系统的运行有着最直接的影响,数据之间的正确关系的梳理是系统有效运行,产生价值的基石。
数据之间的关联性可以从下面几个方面分析:
时间关联性:即同一时刻的数据照相,数据是同一时刻系统产生的,它反映的是系统这一时刻的状态,从数据世界角度看,这个系统就是这一时刻的数据集合。数据照相体现的是系统静态展示;时间戳是这类数据关键的因素,因此要求各个数据获取的时间戳必须相同,时间戳是目前很多数据所缺失的,也是物联网实施中需要关注和解决的问题之一。
流程关联性:即一个点的数据进过一定时间后影响第二个点数据的产生,它体现的是系统动态的流程展示。数据之间的流程关系性需要模型提供,并在实施中进行修正。
数据的时效性
数据的时效性是指数据产生到其被清除的时间,数据时效性是由系统的实施部署所决定。数据可以被使用多次也可以被使用一次后就可以被清除。总体来说远程部署数据还是边缘部署数据影响着数据的时效性,通常边缘部署的数据时效性短,远程数据的时效性长。边缘部署需要的数据通常及时性强,但是边缘存储空间,计算能力弱因此不能长期保存;远程数据通常为历史性数据展示、计算分析,同时云端空间、计算的伸缩性强,因此数据时效性长。
数据的实时性也是数据时效性的一部分,实时性和数据的部署位置,数据的重要性以及传输方式都有关联性。
以数据为中心的物联网设计方法论
总结物联网中的各类数据及特性或者抽象其通用性的目的是为了更好的选择不同的物联网技术进行快速、有效的实施。以数据为中心的物联网解决方案甚至商业模式将会是物联网的主流设计思想。
下文将从数据如何采集,数据如何预处理、数据如何传输等不同的角度进行分析如何应用物联网的各种技术。
以数据流向为核心的设计思路
从数据流向来设计包括:数据采集、数据汇聚、数据传输、数据持久化、数据展示、数据处理、数据矫正、数据消费。
以数据生产/消费的为核心的设计思路
生产/消费为核心的设计思路多以云端业务为中心,尤其整合现有各个分散子系统为目标或者产业链上下游的协同操作,物联网的数据多以关键数据指标类型为主或者为起始数据角色。
1)下面为供应链的数据流设计思路。
2)下面为综合管理系统设计
了解物联网数据是什么,并能够提出相应的物联网技术,掌握有价值的数据是物联网方案技术层面的第一步。同样也是物联网技术最终的具象单元——“有价值的数据”。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化时代,数据分析已成为企业决策、业务优化、增长突破的核心支撑,从数据仓库搭建(如维度表与事实表的设计)、数据采集清 ...
2026-03-16在数据仓库建设、数据分析(尤其是用户行为分析、业务指标分析)的实践中,维度表与事实表是两大核心组件,二者相互依存、缺一不 ...
2026-03-16数据是CDA(Certified Data Analyst)数据分析师开展一切工作的核心载体,而数据读取作为数据生命周期的关键环节,是连接原始数 ...
2026-03-16在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06