
中国离大数据“潮头”还差几步_数据分析师培训
“在中国,数据正日益成为决策的依据,创新的源泉,推动从制造到创造的转变。”阿里云总裁胡晓明在此间举行的“2015贵阳国际大数据产业博览会暨全球大数据时代贵阳峰会”上这样表示。与会的企业家和专家认为,中国发展大数据产业力度空前,但在新一轮技术变革中,要想勇立“潮头”,还需突破“各自为战”和“一哄而上”等障碍。
从IT到DT,中国的步伐越来越快
“从每一代信息技术变革来看,中国的步伐是越来越快。”京东大数据部副总经理邢志峰说,在传统的IT时代,中国是西方的“追随者”,不断学习先进的技术。在移动互联网时代,中国与国际社会“并驾齐驱”,其中腾讯、阿里巴巴等企业与国外同类企业不相上下。进入“互联网+”的DT时代,中国一些大数据企业和人才甚至处于国际“领跑”地位。
他说:“中国拥有全球最大的人口基数和数据量,背后的‘数据金矿’也最大。以前非常向往国际大企业的大数据人才,现在愿意在国内的企业发展。”据预测,2020年中国数据总量将达到8.4ZB,占全球数据总量的24%,届时将成为世界第一数据大国和“世界数据中心”。
业内人士认为,随着宏观产业环境的不断优化,中国大数据产业链正在加速形成。众多互联网企业围绕大数据展开的技术研发、应用创新取得进展,医疗卫生、金融、交通等传统行业也在积极利用大数据进行有效探索。
记者了解到,中国部分互联网公司在大数据应用方面处于全球领先水平,他们建立了大数据平台,在分布式系统、超大规模数据仓库、深度学习等关键技术上有所突破。数据采集。存储、处理、分析、服务的大数据产业体系日趋成熟。
工业和信息化部副部长怀进鹏在会议上表示,当前中国“无论是技术储备、产业基础和政策发展环境,都为大数据、云计算的发展创造了先机,也做好了重要的支撑和基础。”
强劲势头中存隐忧
此次博览会云集了来自北京、上海、浙江、贵州等地的上百家大数据企业。企业家们在畅想中国大数据前景时,对当前各地发展大数据产业“各自为战”和配套设施“一哄而上”的局面表示了担忧。
胡晓明说,现在各地互联网数据中心建设存在泛滥现象,有的地方,市、县、乡都在搞大数据、云计算,“全民大数据”容易导致新一轮的硬件建设,造成资源浪费,对数据集聚有负面作用,“并不是建起了数据中心就有数据”。
一些专家指出,在全球金融市场低迷、中国经济转型的背景下,发展大数据产业是一种“现实选择”。不少欠发达地区对此寄予“弯道超车”厚望,各地自行探索难以形成合力,发展过程中容易出现重复建设,对大数据产业健康发展埋下隐患。
同时,政府部门信息共享和公开,以及涉及个人隐私和商业机密的专门法律法规和政策环境不够完善。政府和垄断部门的信息共享和开放程度不够,众多“信息孤岛”造成大数据产业的数据资源不够丰富。而企业拥有的大数据技术和计算能力却无用武之地,陷入“巧妇难为无米之炊”状态。
在记者采访中多家企业反映,即使拿到公共大数据,但由于政府部门条线分割严重、缺乏数据存储规范标准,这些数据十分杂乱,融合成本高昂,企业难以承受。“很多记录下来的数据没有规范化,也没有对数据存储进行设计,即使在同一个行业,数据也是‘一人一个模样’。”百度大数据部副总裁陶海亮说。
香港城市大学教授马建和中国信息协会大数据专委会副主任委员文金言认为,目前中国大数据产业距离“潮头”的差距还表现在大数据处理工具是“他山之石”,一些知名企业用的都是国外的数据处理技术,自主核心技术突破还有待时日。
清晰定位防其“野蛮生长”
确立大数据思维被认为是突破大数据发展障碍的重要抓手。有专家指出,当前一些地方政府缺乏“数据治理”意识,形成了做决策靠经验判断的惯性思维。一项针对我国主要部委信息化部门的调查显示,近4成的部门负责人没有意识到大数据可以帮助提升业务能力。
此次产业博览会上,一些与会者提出,政府应制定清晰的大数据、云计算顶层设计。从数据主权、数据创新能力、关键技术、人才、数据研究、覆盖全行业的产业链、法制环境支持等关键要素入手,研究大数据发展趋势,评估大数据对政府、经济与社会运行所带来的革命性影响
同时,制定未来5年或更长时间的发展目标、发展原则、关键技术、重点任务、行动计划和保障措施等规划,以协同政府各部门、各行业主管单位、企事业单位和个人等各方面的力量,形成共同发展的氛围。
邢志峰说,解决“信息孤岛”问题,最为迫切的是政务公开,“越多政务数据被公开,就会创造越多的机会和价值”。政府应加快推进数据的分级和公开,同时采用政府购买服务的方式,带动数据资源成为社会治理,优化城市管理和经济决策的重要资源。
国家信息中心专家委员会副主任宁家骏认为,各地数据中心的建设规模应以产业实际需求为导向,做到精细化设计,针对性开发,促进大数据产业形成良好、可持续的发展生态环境,而不是任其“野蛮生长”。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01