
数据不在于大小 关键得有价值 各路大咖论剑大数据应用
一场会议不仅来了两位院士,连国际大数据分析大会主席都专门作了主题演讲,只能坐下300人的会议厅连走廊过道都站满了听众……如果利用大数据为本次软博会的分场论坛制作一张热力图的话,昨天下午国展中心的扬子厅一定是颜色最深的那一个。因为这里讨论的是目前被社会各界关注的大数据如何与产业融合创新的问题。
大数据是这两年互联网普及运用带来的一个热词,随着信息爆炸和所有人群电子痕迹的采集,全世界的大数据容量正在以令人难以置信的速度快速增长。据有关方面不完全统计,2004年全球的大数据容量约为30EB(以日常接触的手机内存容量GB为标准,一EB大约等于11亿GB),到2013年这个数字已经是35000EB,而且这一容量每年都在呈几何级数不断增加。对于已经达到这样一个量级的数据究竟该怎么处理,不仅仅是计算机硬件的问题,更是软件和整个解决方案架构的问题。因为只有把这些数据处理好了才能建立运用的基础。
“大数据实际上并不是什么新鲜词,早在上世纪80年代就被美国著名的未来学家托夫勒教授提出了,之所以现在大家对这一名词产生新的关注,是因为数据带来的新问题。”来自浙江大学的中国工程院院士谭建荣教授表示,其实直到目前对于什么是大数据还没有一个专业的定义,最被大家所接受的说法是运用现有技术、现有手段、现有方法没办法处理的数据就是大数据。因此,要解决大数据的运用问题,首先要解决大数据的处理难题。在谭建荣看来,因为现在大家对众多的数据哪些有用哪些没用并不清楚,只有首先做到海量的数据提取,才有可能从中找到有价值的数据。
来自加拿大工程院的凌晓峰院士则认为数据没有大小之分,关键是找到其中的价值。为了便于会场的听众理解,凌院士专门找来一张个人信贷支出的数据,在排除干扰数据后,利用有效数据来提前判定个人信用违约发生的可能性。“如果把这一功能延展,可以在个人饮食、医疗健康等各领域得到充分运用。”凌晓峰院士认为在互联网普及发展的今天,需要一个平台来让各种大数据完成交互,进而形成系统,才能最终实现大数据唱戏的结果。
记者了解到,作为本次软博会确定创建的软件名城示范区,中国(南京)软件谷主导建设的南京大数据产业基地已集聚大数据企业135家,尤其2015年9月南京市大数据产业协会成立后,构建了“协会(联盟)+平台+基地+基金”产业链发展新模式,初具特色的大数据产业体系已基本形成。目前,南京软件谷在大数据产业发展方面已形成了“五大产业集群”,分别是以华为、中兴、步步高等为龙头的通信及智能终端产业集群;以SAP、亚信等为引领的云计算、大数据及移动互联网产业集群;以欧飞、润和等为支柱的电子商务及互联网金融产业集群;以中兴光电子、美满、天溯等为核心的物联网及芯片设计产业集群;以中电十四所、宏图三胞、舜天等为平台的旗舰经济。
成立不到4年的一家大数据处理公司运满满,该平台撮合司机、货主双方在平台上进行对接,汇聚全国95%的货物信息、78%的重卡司机,每日产生TB级的海量数据,包括司机行驶里程、路线、交易行为等大数据沉淀,运用大数据、云计算、人工智能精准车货匹配、计算最佳路径、预测回程配货概率,降低空驶率。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-07-30SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-07-30人工智能对CDA数据分析领域的影响 人工智能对 CDA(Certified Data Analyst,注册数据分析师)数据分析领域的影响是全方位、多层 ...
2025-07-30MySQL执行计划中rows的计算逻辑:从原理到实践 MySQL 执行计划中 rows 的计算逻辑:从原理到实践 在 MySQL 数据库的查询优化中 ...
2025-07-29左偏态分布转正态分布:方法、原理与实践 左偏态分布转正态分布:方法、原理与实践 在统计分析、数据建模和科学研究中,正态分 ...
2025-07-29CDA 数据分析师的职业生涯规划:从入门到卓越的成长之路 在数字经济蓬勃发展的当下,数据已成为企业核心竞争力的重要来源,而 CD ...
2025-07-29CDA数据分析师证书考取全攻略 一、了解 CDA 数据分析师认证 CDA 数据分析师认证是一套科学化、专业化、国际化的人才考核标准, ...
2025-07-29解析神经网络中 Softmax 函数的核心作用 在神经网络的发展历程中,激活函数扮演着至关重要的角色,它们为网络赋予了非线性能力, ...
2025-07-29解析 response.text 与 response.content 的核心区别 在网络数据请求与处理的场景中,开发者经常需要从服务器返回的响应中提取数 ...
2025-07-29鸢尾花判别分析:机器学习中的经典实践案例 在机器学习的世界里,有一个经典的数据集如同引路明灯,为无数初学者打开了模式识别 ...
2025-07-29用 Python 开启数据分析之旅:从基础到实践的完整指南 在数据驱动决策的时代,数据分析已成为各行业不可或缺的核心能力。而 Pyt ...
2025-07-29从 CDA LEVEL II 考试题型看 Python 数据分析要点 在数据科学领域蓬勃发展的当下,CDA(Certified Data Analyst)认证成为众多从 ...
2025-07-29CDA 数据分析师的工作范围解析 在数字化时代的浪潮下,数据已成为企业发展的核心资产之一。CDA(Certified Data Analyst)数据分 ...
2025-07-29解析 insert into select 是否会锁表:原理、场景与应对策略 在数据库操作中,insert into select 是一种常用的批量数据插入语句 ...
2025-07-29用 Power BI 制作地图热力图:基于经纬度数据的实践指南 在数据可视化领域,地图热力图凭借直观呈现地理数据分布密度的优势,成 ...
2025-07-29从数据到决策:CDA 数据分析师如何重塑职场竞争力与行业价值 在数字经济席卷全球的今天,数据已从 “辅助工具” 升级为 “核心资 ...
2025-07-292025 年 CDA 数据分析师考纲焕新,引领行业人才新标准 在数字化浪潮奔涌向前的当下,数据已成为驱动各行业发展的核心要素。作为 ...
2025-07-29PyTorch 核心机制:损失函数与反向传播如何驱动模型进化 在深度学习的世界里,模型从 “一无所知” 到 “精准预测” 的蜕变,离 ...
2025-07-29t 检验与 Wilcoxon 检验:数据差异分析的两大核心方法 在数据分析的广阔领域中,判断两组或多组数据之间是否存在显著差异是一项 ...
2025-07-29PowerBI 添加索引列全攻略 在使用 PowerBI 进行数据处理与分析时,添加索引列是一项极为实用的操作技巧。索引列能为数据表中的每 ...
2025-07-29