
中国离大数据“潮头”还差几步_数据分析师培训
“在中国,数据正日益成为决策的依据,创新的源泉,推动从制造到创造的转变。”阿里云总裁胡晓明在此间举行的“2015贵阳国际大数据产业博览会暨全球大数据时代贵阳峰会”上这样表示。与会的企业家和专家认为,中国发展大数据产业力度空前,但在新一轮技术变革中,要想勇立“潮头”,还需突破“各自为战”和“一哄而上”等障碍。
从IT到DT,中国的步伐越来越快
“从每一代信息技术变革来看,中国的步伐是越来越快。”京东大数据部副总经理邢志峰说,在传统的IT时代,中国是西方的“追随者”,不断学习先进的技术。在移动互联网时代,中国与国际社会“并驾齐驱”,其中腾讯、阿里巴巴等企业与国外同类企业不相上下。进入“互联网+”的DT时代,中国一些大数据企业和人才甚至处于国际“领跑”地位。
他说:“中国拥有全球最大的人口基数和数据量,背后的‘数据金矿’也最大。以前非常向往国际大企业的大数据人才,现在愿意在国内的企业发展。”据预测,2020年中国数据总量将达到8.4ZB,占全球数据总量的24%,届时将成为世界第一数据大国和“世界数据中心”。
业内人士认为,随着宏观产业环境的不断优化,中国大数据产业链正在加速形成。众多互联网企业围绕大数据展开的技术研发、应用创新取得进展,医疗卫生、金融、交通等传统行业也在积极利用大数据进行有效探索。
记者了解到,中国部分互联网公司在大数据应用方面处于全球领先水平,他们建立了大数据平台,在分布式系统、超大规模数据仓库、深度学习等关键技术上有所突破。数据采集。存储、处理、分析、服务的大数据产业体系日趋成熟。
工业和信息化部副部长怀进鹏在会议上表示,当前中国“无论是技术储备、产业基础和政策发展环境,都为大数据、云计算的发展创造了先机,也做好了重要的支撑和基础。”
强劲势头中存隐忧
此次博览会云集了来自北京、上海、浙江、贵州等地的上百家大数据企业。企业家们在畅想中国大数据前景时,对当前各地发展大数据产业“各自为战”和配套设施“一哄而上”的局面表示了担忧。
胡晓明说,现在各地互联网数据中心建设存在泛滥现象,有的地方,市、县、乡都在搞大数据、云计算,“全民大数据”容易导致新一轮的硬件建设,造成资源浪费,对数据集聚有负面作用,“并不是建起了数据中心就有数据”。
一些专家指出,在全球金融市场低迷、中国经济转型的背景下,发展大数据产业是一种“现实选择”。不少欠发达地区对此寄予“弯道超车”厚望,各地自行探索难以形成合力,发展过程中容易出现重复建设,对大数据产业健康发展埋下隐患。
同时,政府部门信息共享和公开,以及涉及个人隐私和商业机密的专门法律法规和政策环境不够完善。政府和垄断部门的信息共享和开放程度不够,众多“信息孤岛”造成大数据产业的数据资源不够丰富。而企业拥有的大数据技术和计算能力却无用武之地,陷入“巧妇难为无米之炊”状态。
在记者采访中多家企业反映,即使拿到公共大数据,但由于政府部门条线分割严重、缺乏数据存储规范标准,这些数据十分杂乱,融合成本高昂,企业难以承受。“很多记录下来的数据没有规范化,也没有对数据存储进行设计,即使在同一个行业,数据也是‘一人一个模样’。”百度大数据部副总裁陶海亮说。
香港城市大学教授马建和中国信息协会大数据专委会副主任委员文金言认为,目前中国大数据产业距离“潮头”的差距还表现在大数据处理工具是“他山之石”,一些知名企业用的都是国外的数据处理技术,自主核心技术突破还有待时日。
清晰定位防其“野蛮生长”
确立大数据思维被认为是突破大数据发展障碍的重要抓手。有专家指出,当前一些地方政府缺乏“数据治理”意识,形成了做决策靠经验判断的惯性思维。一项针对我国主要部委信息化部门的调查显示,近4成的部门负责人没有意识到大数据可以帮助提升业务能力。
此次产业博览会上,一些与会者提出,政府应制定清晰的大数据、云计算顶层设计。从数据主权、数据创新能力、关键技术、人才、数据研究、覆盖全行业的产业链、法制环境支持等关键要素入手,研究大数据发展趋势,评估大数据对政府、经济与社会运行所带来的革命性影响
同时,制定未来5年或更长时间的发展目标、发展原则、关键技术、重点任务、行动计划和保障措施等规划,以协同政府各部门、各行业主管单位、企事业单位和个人等各方面的力量,形成共同发展的氛围。
邢志峰说,解决“信息孤岛”问题,最为迫切的是政务公开,“越多政务数据被公开,就会创造越多的机会和价值”。政府应加快推进数据的分级和公开,同时采用政府购买服务的方式,带动数据资源成为社会治理,优化城市管理和经济决策的重要资源。
国家信息中心专家委员会副主任宁家骏认为,各地数据中心的建设规模应以产业实际需求为导向,做到精细化设计,针对性开发,促进大数据产业形成良好、可持续的发展生态环境,而不是任其“野蛮生长”。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
PyTorch 核心机制:损失函数与反向传播如何驱动模型进化 在深度学习的世界里,模型从 “一无所知” 到 “精准预测” 的蜕变,离 ...
2025-07-252025 年 CDA 数据分析师考纲焕新,引领行业人才新标准 在数字化浪潮奔涌向前的当下,数据已成为驱动各行业发展的核心要素。作为 ...
2025-07-25从数据到决策:CDA 数据分析师如何重塑职场竞争力与行业价值 在数字经济席卷全球的今天,数据已从 “辅助工具” 升级为 “核心资 ...
2025-07-25用 Power BI 制作地图热力图:基于经纬度数据的实践指南 在数据可视化领域,地图热力图凭借直观呈现地理数据分布密度的优势,成 ...
2025-07-24解析 insert into select 是否会锁表:原理、场景与应对策略 在数据库操作中,insert into select 是一种常用的批量数据插入语句 ...
2025-07-24CDA 数据分析师的工作范围解析 在数字化时代的浪潮下,数据已成为企业发展的核心资产之一。CDA(Certified Data Analyst)数据分 ...
2025-07-24从 CDA LEVEL II 考试题型看 Python 数据分析要点 在数据科学领域蓬勃发展的当下,CDA(Certified Data Analyst)认证成为众多从 ...
2025-07-23用 Python 开启数据分析之旅:从基础到实践的完整指南 在数据驱动决策的时代,数据分析已成为各行业不可或缺的核心能力。而 Pyt ...
2025-07-23鸢尾花判别分析:机器学习中的经典实践案例 在机器学习的世界里,有一个经典的数据集如同引路明灯,为无数初学者打开了模式识别 ...
2025-07-23解析 response.text 与 response.content 的核心区别 在网络数据请求与处理的场景中,开发者经常需要从服务器返回的响应中提取数 ...
2025-07-22解析神经网络中 Softmax 函数的核心作用 在神经网络的发展历程中,激活函数扮演着至关重要的角色,它们为网络赋予了非线性能力, ...
2025-07-22CDA数据分析师证书考取全攻略 一、了解 CDA 数据分析师认证 CDA 数据分析师认证是一套科学化、专业化、国际化的人才考核标准, ...
2025-07-22左偏态分布转正态分布:方法、原理与实践 左偏态分布转正态分布:方法、原理与实践 在统计分析、数据建模和科学研究中,正态分 ...
2025-07-22你是不是也经常刷到别人涨粉百万、带货千万,心里痒痒的,想着“我也试试”,结果三个月过去,粉丝不到1000,播放量惨不忍睹? ...
2025-07-21我是陈辉,一个创业十多年的企业主,前半段人生和“文字”紧紧绑在一起。从广告公司文案到品牌策划,再到自己开策划机构,我靠 ...
2025-07-21CDA 数据分析师的职业生涯规划:从入门到卓越的成长之路 在数字经济蓬勃发展的当下,数据已成为企业核心竞争力的重要来源,而 CD ...
2025-07-21MySQL执行计划中rows的计算逻辑:从原理到实践 MySQL 执行计划中 rows 的计算逻辑:从原理到实践 在 MySQL 数据库的查询优化中 ...
2025-07-21在AI渗透率超85%的2025年,企业生存之战就是数据之战,CDA认证已成为决定企业存续的生死线!据麦肯锡全球研究院数据显示,AI驱 ...
2025-07-2035岁焦虑像一把高悬的利刃,裁员潮、晋升无望、技能过时……当职场中年危机与数字化浪潮正面交锋,你是否发现: 简历投了10 ...
2025-07-20CDA 数据分析师报考条件详解与准备指南 在数据驱动决策的时代浪潮下,CDA 数据分析师认证愈发受到瞩目,成为众多有志投身数 ...
2025-07-18