京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据思维下的统计新变革
日前,谷歌宣布其云计算平台通过大数据分析准确地预测了巴西世界杯8强。据了解,谷歌云计算平台使用了英国体育数据提供商Opta Sports的数据,评估了全球每个职业足球联盟过去多个赛季的情况,以及巴西世界杯小组赛期间的统计数据。于是乎,大数据再度成为舆论关注的焦点,对于其应用价值的讨论更加热烈。
然而,我们发现,即使以谷歌强大的技术实力,也不得不从英国体育数据提供商Opta Sports那里获取数据。也就是说,数据的采集并不是谷歌的优势,大数据产业走向商用和规模化发展,更多的要依赖Opta Sports这样的数据采集者。从这个角度看,作为最具共识性和采集能力的统计部门,无疑将是大数据产业发展壮大的基础。反过来看,从大数据发展的趋势看统计行业的发展方向,也必然全面应用大数据思维。我们注意到,从国家统计局局长马建堂在2012年年底提出“统计部门要拥抱大数据时代”,到不久前国家统计局在厦门建立首个大数据基地,可以断言,统计行业的大数据变革已经到来。
2013年11月,国家统计局与百度、阿里巴巴等11家企业签订了大数据战略合作框架协议。此举目的在于共同推进大数据在政府统计中的应用,不断增强政府统计的科学性和及时性。马建堂在协议签订时表示:“现在许多发达国家纷纷将大数据利用提升到国家战略层面,我们也要适应这一大势,将大数据视为国家战略资源,主动拥抱大数据时代,积极抢抓机遇、应对挑战。”数据与统计是一对共生词,而数据成为生产要素的前提条件也是有效的梳理与归类,这恰恰是统计的内容。马建堂说,大数据为政府统计提供了总体性、非结构化、丰富真实的原始资料,可以极大地缩短数据采集时间,减少报表填报任务,减轻调查对象负担,提高统计数据质量。
一场统计方式和方法的变革正在酝酿。企业既是大数据的主要生产者,也是经验丰富的使用者,还是大数据的直接受益者,有数据的资源、有应用的技术、有市场的机制。而国家统计局作为组织领导和协调全国统计工作的主管部门,具有统计制度和标准制定,统计数据搜集、发布、分析等方面的优势。
统计数据是各级领导作出科学决策的重要支撑。随着企业一套表建设的基本完成,各行各业的数据被采集上来,这只是第一步,用好这些数据是关键。企业一套表只是一个业务系统,更重要的是在这套系统上帮助统计部门搭建一套数据资源体系,通过这套体系来对数据进行规划、整理和加工,建设监测评价中心、辅助决策中心,这也是统计行业未来发展的必然趋势。
现在一些地方统计局已经开始做统计方面的规划和使用。例如原来的统计工作主要是查询,现在希望除了查询、检索、展示之外还具备监测、评价的功能。监测评价需要标准,在政府部门这个标准就是政策。监测是对企业、家庭等对象进行调查,数据上传之后经过计算、加工等与初定的指标相比较,并对监测结果进行评价,发现问题及时预警、报警。辅助决策则更需要智能化,当发现监测评价出的结果与初定指标存在较大差异时,就要追本溯源,为领导提供准确的问题分析报告,列出导致问题的主要原因,提出可行性建议,为领导提供辅助决策,为其做出下一个阶段的判断和调整提供帮助。例如,自去年以来,浙江温州市统计局建立了GDP联席会议制度,按季度召集30多个部门进行分析论证部门数据与GDP数据之间的关系,特别是充分运用电力、银行、交通、财政、外贸等部门数据,以及对GDP数据的影响,使GDP数据更加科学可靠。今年进一步扩大了GDP联席会议职能,把涉及部门的经济、社会、民生等监测评价数据进行综合审查分析,进一步提高统计数据质量。
与此同时,统计行业的大数据变革,也将为大数据产业的下一步发展打造坚实的基础。从企业一套表到电子终端采集数据,中国统计的技术和制度改革近两年不断深入,而与大数据概念的交汇与融合也将助推中国官方数据更加真实全面。统计部门在人口、农业、投资、交通等领域,大力研究利用遥感RS、地理信息系统GIS、全球定位系统GPS为代表的空间信息技术和物联网技术,既极大提升了统计信息化水平,也为进一步推进大数据的统计应用打下了较好的基础。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化时代,每一位用户与产品的交互都会留下可追溯的行为轨迹——电商用户的浏览、加购、下单,APP用户的注册、登录、功能使 ...
2026-03-31在日常数据统计、市场调研、学术分析等场景中,我们常常需要判断两个分类变量之间是否存在关联(如性别与消费偏好、产品类型与满 ...
2026-03-31在CDA(Certified Data Analyst)数据分析师的职场实战与认证考核中,“可解释性建模”是核心需求之一——企业决策中,不仅需要 ...
2026-03-31多层感知机(MLP,Multilayer Perceptron)作为深度学习中最基础、最经典的神经网络模型,其结构设计直接决定了模型的拟合能力、 ...
2026-03-30在TensorFlow深度学习实战中,数据集的加载与预处理是基础且关键的第一步。手动下载、解压、解析数据集不仅耗时费力,还容易出现 ...
2026-03-30在CDA(Certified Data Analyst)数据分析师的日常工作中,“无监督分组、挖掘数据内在聚类规律”是高频核心需求——电商场景中 ...
2026-03-30机器学习的本质,是让模型通过对数据的学习,自主挖掘规律、实现预测与决策,而这一过程的核心驱动力,并非单一参数的独立作用, ...
2026-03-27在SQL Server数据库操作中,日期时间处理是高频核心需求——无论是报表统计中的日期格式化、数据筛选时的日期类型匹配,还是业务 ...
2026-03-27在CDA(Certified Data Analyst)数据分析师的能力体系与职场实操中,高维数据处理是高频且核心的痛点——随着业务场景的复杂化 ...
2026-03-27在机器学习建模与数据分析实战中,特征维度爆炸、冗余信息干扰、模型泛化能力差是高频痛点。面对用户画像、企业经营、医疗检测、 ...
2026-03-26在这个数据无处不在的时代,数据分析能力已不再是数据从业者的专属技能,而是成为了职场人、管理者、创业者乃至个人发展的核心竞 ...
2026-03-26在CDA(Certified Data Analyst)数据分析师的能力体系中,线性回归是连接描述性统计与预测性分析的关键桥梁,也是CDA二级认证的 ...
2026-03-26在数据分析、市场研究、用户画像构建、学术研究等场景中,我们常常会遇到多维度、多指标的数据难题:比如调研用户消费行为时,收 ...
2026-03-25在流量红利见顶、获客成本持续攀升的当下,营销正从“广撒网”的经验主义,转向“精耕细作”的数据驱动主义。数据不再是营销的辅 ...
2026-03-25在CDA(Certified Data Analyst)数据分析师的全流程工作中,无论是前期的数据探索、影响因素排查,还是中期的特征筛选、模型搭 ...
2026-03-25在当下数据驱动决策的职场环境中,A/B测试早已成为互联网产品、运营、营销乃至产品迭代优化的核心手段,小到一个按钮的颜色、文 ...
2026-03-24在统计学数据分析中,尤其是分类数据的分析场景里,卡方检验和显著性检验是两个高频出现的概念,很多初学者甚至有一定统计基础的 ...
2026-03-24在CDA(Certified Data Analyst)数据分析师的日常业务分析与统计建模工作中,多组数据差异对比是高频且核心的分析场景。比如验 ...
2026-03-24日常用Excel做数据管理、台账维护、报表整理时,添加备注列是高频操作——用来标注异常、说明业务背景、记录处理进度、补充关键 ...
2026-03-23作为业内主流的自助式数据可视化工具,Tableau凭借拖拽式操作、强大的数据联动能力、灵活的仪表板搭建,成为数据分析师、业务人 ...
2026-03-23