京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中国大数据在世界上处于第几方阵
“中国与世界其他国家一样,都处在大数据发展的初期阶段。在收集和应用数据方面,中国表现不俗。但在处理分析数据的技术和工具方面,中国与发达国家相比还比较落后。”中国电子信息产业发展研究院副院长樊会文接受《经济日报》记者采访时说。
产业结构有差距
中国大数据在世界上处于第几方阵?对此,工信部赛迪研究院软件所所长潘文表示,大数据产业是新兴产业,中国和世界各国都处于起步阶段,综合排名缺乏统一标准。从大数据产业收集端、处理端和应用端来看,中国在收集端和应用端全球领先,在处理端核心技术方面还有差距。
关注大数据观察网(微信公众号:shuju_net)了解更多精彩资讯
目前,公开数据中还没有对大数据强国的排名,但对全球大数据公司的排名却很多,虽然标准不一,但总体来看,公认的领军企业是亚马逊、SAP、谷歌、IBM等,仍是国外企业居多。
“各个国家在大数据方面的优势各有不同,目前还没法评判谁做得更好。”运满满研究院院长徐强表示,比如,日本在医疗交通方面做得不错,欧洲在数据保护方面领先,新加坡在电子政务方面独树一帜。而即使是大数据核心技术比较领先的美国,在智慧物流、移动支付等部分垂直应用领域也逊色于中国。
“与发达国家相比,中国大数据产业结构落后于全球市场的发展步伐。尤其是美国的大数据产业结构非常好,服务占比很大,而我国的产业结构还处于中低端。”潘文坦言。
从大数据核心产业结构来看,服务是大数据产业的最核心部分。全球市场数据分析服务占整体收入的47.6%,而国内市场数据分析服务在整体收入中占比却比较低,主要企业仍停留在前期的基础软硬件设施投入和部署阶段。樊会文表示,从这个对比可以判断,国内大数据市场虽然已经进入快速增长通道,但仍处于增长的早期阶段。
工信部信息化和软件服务业司副司长李冠宇指出,与发达国家相比,中国在新型计算平台、分布式计算架构、大数据处理、分析和呈现等相关核心技术方面与国外相比仍存在较大差距,对开源技术和相关生态系统的影响力弱。
“目前,美国、英国、法国、澳大利亚等国在大数据核心技术方面居于领先地位。”潘文指出,相关核心技术薄弱还带来数据主权保护的问题。由于数据在网络虚拟空间进行传播,各国都在加强对本国数据的控制力,关注数据主权。美国、欧盟等纷纷利用技术优势和法律法规加强本国数据主权保护,但目前,我国由于基础核心技术支撑能力较弱、数据跨境流动保护规则缺失等,在数据主权保障能力方面还显不足。
应用端一马当先
“中国大数据对世界的贡献主要是三点。”潘文分析说,一是引领大数据的创新应用,特别是在消费领域;二是互联网公司、初创企业引领技术创新步伐,特别是语音识别、图像理解、文本挖掘等方面已涌现出明星企业;三是我国已成为产生和积累数据量最大、数据类型最丰富的国家之一。
苹果在美国推广移动支付多年,效果一直不佳。而在中国,从饭馆到超市,甚至许多菜市场的每个摊位都实现了移动支付。公开数据显示,2016年中国移动支付规模是美国的50倍。
“我国在大数据应用方面处于世界前列,特别是在服务业领域,蓬勃发展的电子商务衍生出一系列基于大数据的互联网金融及信用体系产品,互联网创新应用普及速度非常快。”潘文说。以互联网金融领域为例,蚂蚁金服推出了芝麻信用,其芝麻分来自淘宝、支付宝的数据占30%-40%。通过综合考虑个人用户的信用历史、行为偏好、履约能力、身份特质、人脉关系等信息,直接与其信用挂钩,准确率非常高。
与世界各国相比,中国大数据体量位居前列。我国大型数据中心跨地区经营互联网数据中心业务的企业已达到295家。李冠宇指出,目前中国网民数量超过7亿,移动电话用户突破13亿,均居全球第一。中国已是世界上产生和积累数据体量最大、类型最丰富的国家之一。
“中国网络用户规模大,终端数量多,产业经济规模大,因此在数据规模上具有天然的优势。”樊会文说。
在今年的电子信息博览会主论坛上,科大讯飞董事长刘庆峰播放了一段视频——美国前总统奥巴马感谢科大讯飞让他学会了中文。其实这段视频是由科大讯飞人工智能语音合成系统完成的一次逼真模仿。2016年,科大讯飞在国际语音识别大赛、国际(机器)认知智能大赛中超过了IBM、微软等行业巨头获得大赛指标第一名。
“在许多垂直领域,中国的大数据核心技术处于全球领先。比如在智慧物流领域,中国就比美国发展得好。”徐强表示,调研表明,菜鸟网络、运满满等企业的智慧物流建设,通过为货主和司机提供实时信息数据匹配,可以降低物流运价5%至10%,单车运行效率可以提升30%以上,降本增效效果显著。
中国发展大数据已经具备一定的技术和产业基础。作为信息产业大国和互联网大国,2016年中国软件和信息技术服务业产值4.9万亿元,全球10大互联网企业中国占据4席,为大数据应用奠定了基础。百度、阿里巴巴、腾讯等国内的龙头互联网企业利用自身掌握大量数据资源的优势,不断创新和积累数据处理分析等关键技术,并基于大数据分析优化提升现有业务、开拓新业务,已经具备了建设和运维超大规模大数据平台的技术实力。
加快建设数据强国
2017年,全球大数据市场结构继续向服务化转变,同时从垄断竞争向完全竞争格局演化。典型的表现是,企业数量迅速增多,服务的差异度增大,技术门槛逐步降低,市场竞争越发激烈。据美国国际数据公司(IDC)统计,2017年世界大数据产业市场规模将达1508亿美元,比前一年增加12.4%。其中美国为788亿美元,西欧为341亿美元,两者之和占全世界市场规模的四分之三。
“不同国家、不同公司的统计标准不一样,因此无法绝对比较中国大数据产业市场规模在全球的占比。但可以肯定的是,中国大数据产业规模发展迅速,将很快步入全球前列。”潘文介绍说,赛迪研究院统计数据显示,2016年,包括大数据硬件、大数据软件、大数据服务等在内的大数据核心产业达到3100亿元,大数据关联产业规模达到6万亿元,大数据融合产业规模达到3.5万亿元。工信部发布的《大数据产业发展规划(2016-2020年)》提出,到2020年,大数据相关产品和服务业务收入将突破1万亿元。
中国发展大数据有集中力量办大事的优势。据李冠宇介绍,目前我国已经颁布实施了《促进大数据发展行动纲要》《大数据产业发展规划(2016-2020年)》等一系列重大政策,有20多个地区出台了相关的政策措施,还有20多个地方设立了专门的大数据管理机构,已先后建立8个大数据综合试验区。中国大数据发展呈现良好势头,形成了京津冀、长三角、中西部和东北地区等一批聚集发展区。
潘文认为,中国大数据产业发展将迎来“黄金期”。随着国家大数据战略配套政策措施的制定和实施,我国大数据产业的发展环境将进一步优化,大数据的新业态、新业务、新服务将迎来爆发式增长,产业链进一步成熟和扩张。同时互联网的高速发展,将带动社会各领域对大数据服务需求进一步加强,政务、工业、电信、金融、交通、医疗等领域的应用层出不穷。预计2017年我国大数据核心产业规模有望达到4185亿元,未来3年中国大数据市场规模还将维持40%左右的高速增长。
尽管与发达国家相比,中国大数据发展还存在数据资源开放共享程度低、技术创新与支撑能力不强、大数据产业支撑体系不完善等差距,“但中国要发挥出市场规模大、应用需求旺的优势,以企业为主体集中攻克大数据关键技术,全面提升我国大数据的资源掌控能力、技术支撑能力和价值挖掘能力,加快迈向数据强国。”李冠宇说。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01在时间序列预测任务中,LSTM(长短期记忆网络)凭借对时序依赖关系的捕捉能力成为主流模型。但很多开发者在实操中会遇到困惑:用 ...
2025-12-01引言:数据时代的“透视镜”与“掘金者” 在数字经济浪潮下,数据已成为企业决策的核心资产,而CDA数据分析师正是挖掘数据价值的 ...
2025-12-01数据分析师的日常,常始于一堆“毫无章法”的数据点:电商后台导出的零散订单记录、APP埋点收集的无序用户行为日志、传感器实时 ...
2025-11-28在MySQL数据库运维中,“query end”是查询执行生命周期的收尾阶段,理论上耗时极短——主要完成结果集封装、资源释放、事务状态 ...
2025-11-28在CDA(Certified Data Analyst)数据分析师的工具包中,透视分析方法是处理表结构数据的“瑞士军刀”——无需复杂代码,仅通过 ...
2025-11-28在统计分析中,数据的分布形态是决定“用什么方法分析、信什么结果”的底层逻辑——它如同数据的“性格”,直接影响着描述统计的 ...
2025-11-27在电商订单查询、用户信息导出等业务场景中,技术人员常面临一个选择:是一次性查询500条数据,还是分5次每次查询100条?这个问 ...
2025-11-27