京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中国离大数据“潮头”还差几步_数据分析师培训
“在中国,数据正日益成为决策的依据,创新的源泉,推动从制造到创造的转变。”阿里云总裁胡晓明在此间举行的“2015贵阳国际大数据产业博览会暨全球大数据时代贵阳峰会”上这样表示。与会的企业家和专家认为,中国发展大数据产业力度空前,但在新一轮技术变革中,要想勇立“潮头”,还需突破“各自为战”和“一哄而上”等障碍。
从IT到DT,中国的步伐越来越快
“从每一代信息技术变革来看,中国的步伐是越来越快。”京东大数据部副总经理邢志峰说,在传统的IT时代,中国是西方的“追随者”,不断学习先进的技术。在移动互联网时代,中国与国际社会“并驾齐驱”,其中腾讯、阿里巴巴等企业与国外同类企业不相上下。进入“互联网+”的DT时代,中国一些大数据企业和人才甚至处于国际“领跑”地位。
他说:“中国拥有全球最大的人口基数和数据量,背后的‘数据金矿’也最大。以前非常向往国际大企业的大数据人才,现在愿意在国内的企业发展。”据预测,2020年中国数据总量将达到8.4ZB,占全球数据总量的24%,届时将成为世界第一数据大国和“世界数据中心”。
业内人士认为,随着宏观产业环境的不断优化,中国大数据产业链正在加速形成。众多互联网企业围绕大数据展开的技术研发、应用创新取得进展,医疗卫生、金融、交通等传统行业也在积极利用大数据进行有效探索。
记者了解到,中国部分互联网公司在大数据应用方面处于全球领先水平,他们建立了大数据平台,在分布式系统、超大规模数据仓库、深度学习等关键技术上有所突破。数据采集。存储、处理、分析、服务的大数据产业体系日趋成熟。
工业和信息化部副部长怀进鹏在会议上表示,当前中国“无论是技术储备、产业基础和政策发展环境,都为大数据、云计算的发展创造了先机,也做好了重要的支撑和基础。”
强劲势头中存隐忧
此次博览会云集了来自北京、上海、浙江、贵州等地的上百家大数据企业。企业家们在畅想中国大数据前景时,对当前各地发展大数据产业“各自为战”和配套设施“一哄而上”的局面表示了担忧。
胡晓明说,现在各地互联网数据中心建设存在泛滥现象,有的地方,市、县、乡都在搞大数据、云计算,“全民大数据”容易导致新一轮的硬件建设,造成资源浪费,对数据集聚有负面作用,“并不是建起了数据中心就有数据”。
一些专家指出,在全球金融市场低迷、中国经济转型的背景下,发展大数据产业是一种“现实选择”。不少欠发达地区对此寄予“弯道超车”厚望,各地自行探索难以形成合力,发展过程中容易出现重复建设,对大数据产业健康发展埋下隐患。
同时,政府部门信息共享和公开,以及涉及个人隐私和商业机密的专门法律法规和政策环境不够完善。政府和垄断部门的信息共享和开放程度不够,众多“信息孤岛”造成大数据产业的数据资源不够丰富。而企业拥有的大数据技术和计算能力却无用武之地,陷入“巧妇难为无米之炊”状态。
在记者采访中多家企业反映,即使拿到公共大数据,但由于政府部门条线分割严重、缺乏数据存储规范标准,这些数据十分杂乱,融合成本高昂,企业难以承受。“很多记录下来的数据没有规范化,也没有对数据存储进行设计,即使在同一个行业,数据也是‘一人一个模样’。”百度大数据部副总裁陶海亮说。
香港城市大学教授马建和中国信息协会大数据专委会副主任委员文金言认为,目前中国大数据产业距离“潮头”的差距还表现在大数据处理工具是“他山之石”,一些知名企业用的都是国外的数据处理技术,自主核心技术突破还有待时日。
清晰定位防其“野蛮生长”
确立大数据思维被认为是突破大数据发展障碍的重要抓手。有专家指出,当前一些地方政府缺乏“数据治理”意识,形成了做决策靠经验判断的惯性思维。一项针对我国主要部委信息化部门的调查显示,近4成的部门负责人没有意识到大数据可以帮助提升业务能力。
此次产业博览会上,一些与会者提出,政府应制定清晰的大数据、云计算顶层设计。从数据主权、数据创新能力、关键技术、人才、数据研究、覆盖全行业的产业链、法制环境支持等关键要素入手,研究大数据发展趋势,评估大数据对政府、经济与社会运行所带来的革命性影响
同时,制定未来5年或更长时间的发展目标、发展原则、关键技术、重点任务、行动计划和保障措施等规划,以协同政府各部门、各行业主管单位、企事业单位和个人等各方面的力量,形成共同发展的氛围。
邢志峰说,解决“信息孤岛”问题,最为迫切的是政务公开,“越多政务数据被公开,就会创造越多的机会和价值”。政府应加快推进数据的分级和公开,同时采用政府购买服务的方式,带动数据资源成为社会治理,优化城市管理和经济决策的重要资源。
国家信息中心专家委员会副主任宁家骏认为,各地数据中心的建设规模应以产业实际需求为导向,做到精细化设计,针对性开发,促进大数据产业形成良好、可持续的发展生态环境,而不是任其“野蛮生长”。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、用户运营与业务增长的工作体系中,漏斗拆解是最基础也最高频的问题定位方法。很多业务场景下,我们只能看到最终的转 ...
2026-06-17在数据库开发、数据清洗与报表统计场景中,数值类型转换为日期是高频刚需操作。业务系统常以 Unix 时间戳、整型日期(如20240617 ...
2026-06-17 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-06-17【核心关键词】数据库、电商、知识、产品、数据产品、监管业务、产品经理、业务系统、用户行为分析、用户分析、数据分析、电商 ...
2026-06-16在 Python 动态类型与面向对象的编程体系中,变量定义与类实例化是构建代码逻辑的两大核心基石。变量是数据存储、传递与运算的基 ...
2026-06-16 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据和表结构数据有什么区别”“数据类型误判会引发哪些分析错误” ...
2026-06-16在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-06-10在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09