京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据时代DT+成为大趋势
大数据及其本质特征
大数据是指以服务于决策为目的,需要新型数据处理模式才能对其内容进行采集、存储、管理和分析的海量、高增长率和多样化的信息资本。
大数据具有如下本质特征:一是根本目的是服务于决策,大数据能够帮助各类组织和个人大幅度提升决策能力,做出更好的决策和判断。二是量度大,大数据通常是指100T以上的数据量,这难以依靠传统的计算手段有效计算,而必须依靠新的计算手段和数据挖掘工具。三是频率高,大数据是用户参与互动而产生的数据,根据用户的网络痕迹来及时地了解用户的相关数据,这种数据是按照天甚至小时来计算的高频数据。而传统的数据频率都很低,很多数据是按照月甚至按照年份来计算的。四是速度快,大数据是实时性的数据,能够实时反应。例如,在百度搜索框输入一个关键词,能够瞬间呈现,而传统的数据收集方式则是严重滞后的。五是维度丰富多样,大数据是全样本数据、多维度数据、非结构化数据,既包括普通的结构化数据,又包括视频和音频等非结构化数据。正是因为大数据的维度多样性,其也更为复杂。六是永远在线。在线是大数据的前提条件,从这个角度来说,大数据是永远在线的,能够随时被调用的。大数据通过分析各种网络终端上的用户痕迹,能够更好地分析用户的行为、情感、思想、爱好与需求,来更好地进行决策和分析。七是本质是信息资本。大数据是能够为政府和企业带来未来经济利益的信息资源,其本质是信息资产,而且随着大数据的应用越来越广,其价值会越来越大。因此,不应该仅仅把大数据看成成本,而应把其看成和土地、资本、人才等一样的新生产要素。
政府数据公开是大数据发展的保障
大数据的重要组成部分是政府数据,因此政府数据公开的程度和广度将在很大程度上决定着大数据的发展水平。目前,美国等西方发达国家大力推进数据开放运动,在数据公开程度上居于世界前列。2011年9月20日,美国、巴西、印度尼西亚、墨西哥、挪威、菲律宾、南非、英国等八个国家(G8)联合签署了《开放数据声明》,在纽约发起“开放政府联盟”(OGP),以向本国社会开放更多的信息。2013年6月,八国集团首脑签署了《开放数据宪章》,制定开放数据行动方案,并设定了开放数据宪章的五大原则:开放数据为默认;为激励创新发布数据;为改善治理发布数据;注重数量和质量;让所有人可用。尤其需要指出的是,其中最重要的一条就是“开放为默认,不开放为特例”的原则,这就约束政府部门尽最大可能地公开所有数据,而反观我国,由于政府数据开放的程度很低,各部门基于自身的利益,基本上采取的是“开放为特例,不开放为默认”的原则,这也导致形成一个个的“信息孤岛”。
2007年,国务院通过了《中华人民共和国政府信息公开条例》,国务院办公厅印发的《2015年政府信息公开工作要点》更加明确地强调推进行政权力清单、财政资金、公共服务、国有企业、环境保护等九大领域的信息公开工作。2015年8月19日,国务院总理李克强主持召开国务院常务会议,通过《关于促进大数据发展的行动纲要》。目前,我国的政府数据开放存在着四大挑战:一是开放与安全,在实践中,很多人以数据安全为由来反对数据开放,这是一种很片面的观点;二是人才和文化,我国的数据人才在量和质上都存在重大缺陷,而且也没有形成“数据文化”;三是政策标准不统一;四是政策法规不健全。
在政府数据开放方面,我国存在三大主要问题:一是我国尚未建立起全国统一的大数据平台,导致形成一个个的信息孤岛,影响了政府数据开放的成效;二是我国的数据污染很严重,很多原始数据存在夸大或瞒报现象;三是一些地方没有把大数据当成政府公共服务的重要部分,而当成盈利的资源。
大数据蕴藏着新哲学思想和优势
首先,大数据拓展了新的哲学思想。大数据既能处理“因果关系”又能处理“相关关系”,即不仅能够回答“为什么”又能回答“是什么”。在小数据时代,只能通过抽样调查的方式来回答“为什么”。而大数据则能通过全样本的方式来回答“是什么”,即发现相关关系,这能够帮助我们更好地认识和了解世界。例如,沃尔玛发现在尿布旁边放上啤酒能够提高啤酒的销量,就把尿布和啤酒混搭销售。毫无疑问,尿布和啤酒之间并无因果关系,而二者在一起就形成很好的相关关系。
其次,大数据分析具有显著优势。一是大数据能够实现分析的高度智能化,既能实现信息收集和分析的智能化,又能实现数据与用户需求的有效匹配。二是及时、迅速。大数据分析改变之前的市场调研和数据分析相对滞后的模式和方式,能够及时、迅速地进行分析。例如,传统的市场调研一般耗时几个月,而基于互联网的大数据调研则只需要几天就能得到调研结果。三是成本相对较低。由于可以大量使用技术手段,其成本相应较低。一般来说,传统的市场调研方式,每一份问卷都需要近百元,而互联网调研一份问卷只需要4元左右。
大数据实施的三大关键点
首先,数据的可获得度。目前在国内,大数据的发展严重受制于政府信息的公开性不够,很多数据难以获得,导致难以实现真正的大数据挖掘和分析,这就要求政府及时开放更多的数据,以提高数据的可获得度。
其次,进行科学的模型建构。模型的科学性直接决定着数据分析的质量,这就要求有高超的建模水平,当然数据量越多也有助于模型的合理构建。
第三,利用专家对观点进行提炼。为决策提供依据的基于数据挖掘的独到、高质量的观点,高度依赖于高质量的数据解释,这就体现了行业专家的价值。
在大数据时代,大数据已经成为整个社会的底层架构和标配,其上的一切都必须按照大数据的要求进行重构,大数据在解决大问题方面尤为有效,目前在语音搜索、智慧城市建设、互联网金融治理等方面取得了长足的进展,未来更多的领域都必将被大数据所革命和重构。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析的核心价值在于用数据驱动决策,而指标作为数据的“载体”,其选取的合理性直接决定分析结果的有效性。选对指标能精准定 ...
2026-01-23在MySQL查询编写中,我们习惯按“SELECT → FROM → WHERE → ORDER BY”的语法顺序组织语句,直觉上认为代码顺序即执行顺序。但 ...
2026-01-23数字化转型已从企业“可选项”升级为“必答题”,其核心本质是通过数据驱动业务重构、流程优化与模式创新,实现从传统运营向智能 ...
2026-01-23CDA持证人已遍布在世界范围各行各业,包括世界500强企业、顶尖科技独角兽、大型金融机构、国企事业单位、国家行政机关等等,“CDA数据分析师”人才队伍遵守着CDA职业道德准则,发挥着专业技能,已成为支撑科技发展的核心力量。 ...
2026-01-22在数字化时代,企业积累的海量数据如同散落的珍珠,而数据模型就是串联这些珍珠的线——它并非简单的数据集合,而是对现实业务场 ...
2026-01-22在数字化运营场景中,用户每一次点击、浏览、交互都构成了行为轨迹,这些轨迹交织成海量的用户行为路径。但并非所有路径都具备业 ...
2026-01-22在数字化时代,企业数据资产的价值持续攀升,数据安全已从“合规底线”升级为“生存红线”。企业数据安全管理方法论以“战略引领 ...
2026-01-22在SQL数据分析与业务查询中,日期数据是高频处理对象——订单创建时间、用户注册日期、数据统计周期等场景,都需对日期进行格式 ...
2026-01-21在实际业务数据分析中,单一数据表往往无法满足需求——用户信息存储在用户表、消费记录在订单表、商品详情在商品表,想要挖掘“ ...
2026-01-21在数字化转型浪潮中,企业数据已从“辅助资源”升级为“核心资产”,而高效的数据管理则是释放数据价值的前提。企业数据管理方法 ...
2026-01-21在数字化商业环境中,数据已成为企业优化运营、抢占市场、规避风险的核心资产。但商业数据分析绝非“堆砌数据、生成报表”的简单 ...
2026-01-20定量报告的核心价值是传递数据洞察,但密密麻麻的表格、复杂的计算公式、晦涩的数值罗列,往往让读者望而却步,导致核心信息被淹 ...
2026-01-20在CDA(Certified Data Analyst)数据分析师的工作场景中,“精准分类与回归预测”是高频核心需求——比如预测用户是否流失、判 ...
2026-01-20在建筑工程造价工作中,清单汇总分类是核心环节之一,尤其是针对楼梯、楼梯间这类包含多个分项工程(如混凝土浇筑、钢筋制作、扶 ...
2026-01-19数据清洗是数据分析的“前置必修课”,其核心目标是剔除无效信息、修正错误数据,让原始数据具备准确性、一致性与可用性。在实际 ...
2026-01-19在CDA(Certified Data Analyst)数据分析师的日常工作中,常面临“无标签高维数据难以归类、群体规律模糊”的痛点——比如海量 ...
2026-01-19在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15