京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中国工业大数据的实践与思考
先分享一下我对工业大数据的理解。
简单来讲,工业大数据就是在工业领域信息化相关应用中所产生的海量数据,注意这里的“相关应用”意味着不仅包括企业内和产业链,还包括客户用户和互联网上的数据。
2012年,GE公司率先明确了“工业大数据”的概念。同年麦肯锡的报告中给出了一个有趣的事实:那就是在虚拟经济占主导地位的美国,其工业界蕴含的数据总量反而是最大的。
同时GE公司的报告还揭示了工业大数据所蕴含的巨大价值。
那么,为什么今天提出“工业大数据”?我感觉有几个重要背景,第一是数字化装备和产品的普及,第二装备和产品网络化连接的普及(互联网),第三是企业向服务型制造转型,第四“从摇篮到摇篮”制造的必然要求。无疑“智慧互联设备”、“工业4.0”和“工业互联网”都顺应了这样一个趋势。
下面汇报我自己对工业大数据的几点思考:
工业大数据从哪里来?工业大数据来源于产品生命周期的各个环节,包括市场、设计、制造、服务、再利用各个环节,每个环节都会有大数据,“全”生命周期汇合起来的数据更大,当然企业外、产业链外的“跨界”数据也是工业大数据“不可忽视”的重要来源。
其次,工业大数据和企业已有数据之间的关系?传统企业信息化的“四大件”,广义PLM系统(包括CAX)支持产品开发、ERP系统负责“人财物、产供销”、SCM系统协调供应链,CRM系统关照企业客户和用户,这些系统一般架构在关系数据库系统之上,显然这些系统中的数据是工业大数据,是其中的“20%”部分。
第三,工业大数据和业务流程的关系?传统企业信息化项目一般是从梳理业务流程起步的,流程“主动”、数据“被动”。而工业大数据环境下,要求企业快速满足个性化用户需求,企业僵化的“长流程”,难以适应“实时决策”的要求,需要变“流程驱动”为“数据驱动”,至少是“混合驱动”,“流程”和“数据”深度融合。上述表现,就是我们说的“流程碎片化”,数据成为连接这些“碎片”的媒介。
最后一个思考是,工业大数据有没有“交钥匙”工程?新世纪以来,我国工业界经历了轰轰烈烈的信息化浪潮,“不搞信息化等死,搞了信息化找死”,后半句话告述我们,“信息化”是有难度和风险的,所以“交钥匙”工程成了广大企业所期望的方式。
我个人的观点,工业大数据不存在“交钥匙”工程(至少现在),原因如下:
1) 工业大数据项目主要不是针对“现有业务”,而是针对“未来业务”、“创新业务”的,其魅力在于创新性、不确定性;
2) 工业大数据现在还处在“科学”阶段,人们对数据价值的“提取”方法、技术与工具尚不成熟,特别是以物理规律为发现目标的工业大数据处理更是刚刚起步;
3) 人们普遍认同的“领域专家”、“统计专家”和“软件专家”组成的协同团队,是当前“大数据”深度应用的有效方法。
最后,和大家分享一下我们在工业大数据方面的“小实践”:
在工业产品全生命周期的各个阶段都有大数据,比如设计阶段引入用户社区数据,制造阶段使用机床在线测量数据,在市场营销阶段使用社交网络数据等。在这里,和大家分享一下使用过程中产生的装备工况大数据。
首先,工况大数据平台不是单独存在的,需要嵌入企业已有信息系统,比如客户服务系统,需要将大数据系统与SQL系统进行融合协同应用,有时需要切换原来的数据管理系统,在实践中我们总结出“四阶段”切换方案。
根据我们的实践,工况大数据的典型应用场景如下页面所示:
首先看时空监管的例子。当得到工况数据以后,首先是对一般运营进行监管,不同于传统的运营监管,在大数据技术支持下,运营是成套设备互相协同的运营,例如:以搅拌站为例,通过收集位置数据、油位数据可以对搅拌车运输的过程进行优化调度,从而避免拥堵、减少等待、降低能耗。
再举个例子,我们知道液压系统是工程机械的核心系统之一,导致故障的原因有很多,例如:密封套腐蚀,内壁刮花,密封环损坏,阀块受损,等等。有了工况大数据就可以寻找深层次原因。
有了工况大数据,我们通大规模过比对开工指标,从典型取值、波动幅度、回传密度多个维度进行分析,自动搜索推荐与故障车辆关系密切的特征工况,发现这些故障车辆的每分钟换向次数在变化幅度上高度相关。
再通过引入互联网上的行政区划数据和历年高铁建设数据(企业外部数据),可以得出这样一个结论,这些典型故障均发生在2012年~2013年期间在建重大工程“杭深高铁”沿线,这为我们寻找更深层次的原因提供了重要线索。
最后,我们可以通过大规模工况数据透视宏观装备应用情况,可以根据这些信息,进行易损配件需求的预测,优化调配我们的服务资源,甚至我们可以推测各地宏观经济情况。
这里我想说,工业大数据刚刚起步,需要冷静思考,坚持应用驱动,最终实现我们的目标。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化运营中,“凭感觉做决策” 早已成为过去式 —— 运营指标作为业务增长的 “晴雨表” 与 “导航仪”,直接决定了运营动作 ...
2025-10-24在卷积神经网络(CNN)的训练中,“卷积层(Conv)后是否添加归一化(如 BN、LN)和激活函数(如 ReLU、GELU)” 是每个开发者都 ...
2025-10-24在数据决策链条中,“统计分析” 是挖掘数据规律的核心,“可视化” 是呈现规律的桥梁 ——CDA(Certified Data Analyst)数据分 ...
2025-10-24在 “神经网络与卡尔曼滤波融合” 的理论基础上,Python 凭借其丰富的科学计算库(NumPy、FilterPy)、深度学习框架(PyTorch、T ...
2025-10-23在工业控制、自动驾驶、机器人导航、气象预测等领域,“状态估计” 是核心任务 —— 即从含噪声的观测数据中,精准推断系统的真 ...
2025-10-23在数据分析全流程中,“数据清洗” 恰似烹饪前的食材处理:若食材(数据)腐烂变质、混杂异物(脏数据),即便拥有精湛的烹饪技 ...
2025-10-23在人工智能领域,“大模型” 已成为近年来的热点标签:从参数超 1750 亿的 GPT-3,到万亿级参数的 PaLM,再到多模态大模型 GPT-4 ...
2025-10-22在 MySQL 数据库的日常运维与开发中,“更新数据是否会影响读数据” 是一个高频疑问。这个问题的答案并非简单的 “是” 或 “否 ...
2025-10-22在企业数据分析中,“数据孤岛” 是制约分析深度的核心瓶颈 —— 用户数据散落在注册系统、APP 日志、客服记录中,订单数据分散 ...
2025-10-22在神经网络设计中,“隐藏层个数” 是决定模型能力的关键参数 —— 太少会导致 “欠拟合”(模型无法捕捉复杂数据规律,如用单隐 ...
2025-10-21在特征工程流程中,“单变量筛选” 是承上启下的关键步骤 —— 它通过分析单个特征与目标变量的关联强度,剔除无意义、冗余的特 ...
2025-10-21在数据分析全流程中,“数据读取” 常被误解为 “简单的文件打开”—— 双击 Excel、执行基础 SQL 查询即可完成。但对 CDA(Cert ...
2025-10-21在实际业务数据分析中,我们遇到的大多数数据并非理想的正态分布 —— 电商平台的用户消费金额(少数用户单次消费上万元,多数集 ...
2025-10-20在数字化交互中,用户的每一次操作 —— 从电商平台的 “浏览商品→加入购物车→查看评价→放弃下单”,到内容 APP 的 “点击短 ...
2025-10-20在数据分析的全流程中,“数据采集” 是最基础也最关键的环节 —— 如同烹饪前需备好新鲜食材,若采集的数据不完整、不准确或不 ...
2025-10-20在数据成为新时代“石油”的今天,几乎每个职场人都在焦虑: “为什么别人能用数据驱动决策、升职加薪,而我面对Excel表格却无从 ...
2025-10-18数据清洗是 “数据价值挖掘的前置关卡”—— 其核心目标是 “去除噪声、修正错误、规范格式”,但前提是不破坏数据的真实业务含 ...
2025-10-17在数据汇总分析中,透视表凭借灵活的字段重组能力成为核心工具,但原始透视表仅能呈现数值结果,缺乏对数据背景、异常原因或业务 ...
2025-10-17在企业管理中,“凭经验定策略” 的传统模式正逐渐失效 —— 金融机构靠 “研究员主观判断” 选股可能错失收益,电商靠 “运营拍 ...
2025-10-17在数据库日常操作中,INSERT INTO SELECT是实现 “批量数据迁移” 的核心 SQL 语句 —— 它能直接将一个表(或查询结果集)的数 ...
2025-10-16