京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据:开放与跨界才有价值_数据分析师
主持人撕开信封,取出一天前写好并放进去的关于中国两座水库、美国一座水库当日8点的水位预测数据,竟然发现一天前的预测和实际数据相差无几……这是近日出现在“云上贵州”大数据商业模式大赛现场的一幕,是大数据应用于实际生活的典型案例。
在专家们看来,数据的开放和跨界融合,是大数据产业得以发展壮大的关键。发展大数据产业,也是推动互联网+的必然需求。
大数据并不遥远
收集美国气象局、中国气象局、欧洲天气预报中心的公开数据,加上对各大河流的地貌数据,东方科技董事长李胜利用自己的独特算法,就可以提前预测全球任何一个水电站是否会遭遇大洪水……这就是“东方祥云”项目的魅力所在,也让大众真实感受到大数据的魔力。
在大数据商业模式大赛的决赛中,“东方祥云”项目最终获得一等奖,从惠及民生的角度来说,这一奖项实至名归。
中国是一个水资源匮乏但水害多发的国家,仅2013年全国因洪涝灾害死亡的人数就达1148人。2007年7月,贵州平塘发生特大洪水,造成5.7亿元直接经济损失。2012年7月,该县再次遭遇特大洪水,不但无一人伤亡,直接经济损失也降到6000万元。
“原因在于,2010年受灾后,平塘县安装了我们的山洪灾害预警监测平台,得到洪水预报,及时采取措施。”李胜告诉《中国科学报》记者,全国约有15万座水电站、水库,如果使用东方祥云的大数据技术进行来水预报服务,并合理调度用水,可为水库、水电站节省90%的运维成本。
在这次比赛中,这样的项目并不少见。比如,大赛获奖项目“蜂能”,通过智能用电终端和强大的数据运算系统,采集设备用电数据,对其分析并进行节电和需求优化管理,可实现节约用电10%~20%。
“在一些具体的产业,大数据已经应用得非常广。实际上,大数据挖掘是推动互联网+的有效方式。”清华大学教授韩亦舜对《中国科学报》记者表示,本次大赛的众多获奖项目,就体现出“大数据时代已经到来”。
开放才有价值
在专家们看来,大数据只有开放才有价值,封闭、不流通的数据无法形成产业。
“如果没有美国气象局等机构在网络公开的气象数据,我们即便有最精确的算法,也无法做到水库水位的提前预报。气象数据和地貌、水文数据的跨界与沟通,才能让我们的计算更加准确。”李胜坦言。
韩亦舜指出,包含丰富的数据源是大数据产业发展的前提。但是,我国政府、企业和行业信息化系统建设往往缺少统一规划和科学论证,系统之间缺乏统一的标准,形成了众多“信息孤岛”,而且受行政垄断和商业利益所限,数据开放程度较低,这给数据利用造成极大障碍,亟须改变。“云上贵州”提出逐步开放数据,无疑具有重大的意义。
贵州省经济和信息化委员会主任李保芳也向《中国科学报》记者表示,政府数据资源应当在安全前提下逐步有序适当开放。“事实上,政府通过数据开放,改进公众服务和社会管理,营造创新环境和释放商业机会,市民、企业和政府都将是开放数据的受益者。”
仍待深度挖掘
贵州省经信委提供的相关报告显示,2014年贵州大数据信息产业实现规模总量1460亿元,电子信息产业单月规模达到130亿元。
韩亦舜认为,未来,人类一切生产、生活包括民生、环保、公共安全、城市服务、工商业活动都将囊括在智慧体系的理想服务之下,而智慧的来源便是大数据。
“大数据作为一种资源,其独特性在于可重复利用,而且可以在不断的挖掘中继续产生新的价值。”阿里巴巴集团副总裁、大数据专家涂子沛指出,从目前来看,亟须对数据进行深度挖掘。
“目前,在大数据产业领域,我国与各工业强国基本上处于同一起跑线。只要充分利用大数据产生的力量,未来可以帮助中国产业实现弯道超车。 ”清华大学副校长杨斌说。
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-05-07在数字化时代,商业竞争的核心已从“经验驱动”转向“数据驱动”,越来越多的企业意识到,商业分析不是简单的数据统计与报表呈现 ...
2026-05-06在Excel数据透视表的实操中,“引用”是连接透视表与公式、辅助数据的核心操作,而相对引用作为最基础、最常用的引用方式,其设 ...
2026-05-06 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-05-06在Excel数据分析中,数据透视表是汇总、整理海量数据的高效工具,而公式则是实现数据二次计算、逻辑判断的核心功能。实际操作中 ...
2026-04-30Excel透视图是数据分析中不可或缺的工具,它能将透视表中的数据快速可视化,帮助我们直观捕捉数据规律、呈现分析结果。但在实际 ...
2026-04-30 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-04-30在中介效应分析中,人口统计学变量(如年龄、性别、学历、收入、职业等)是常见的控制变量或调节变量,其处理方式直接影响分析结 ...
2026-04-29在SQL数据库实操中,日期数据的存储与显示是高频需求,而“数字日期”(如20240520、20241231、45321)是很多开发者、数据分析师 ...
2026-04-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-04-29在手游行业竞争日趋白热化的当下,“流量为王”早已升级为“留存为王”,而付费用户留存率更是衡量一款手游盈利能力、运营质量的 ...
2026-04-28在日常MySQL数据库运维与开发中,经常会遇到“同一台服务器上,两个不同数据库(以下简称“源库”“目标库”)的表数据需要保持 ...
2026-04-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-04-28箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-04-27在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24