京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据:第二次数据革命_数据分析师
【核心提示】与传统数据相比,大数据的资源性特征尤为突出,成为各国重视开发大数据的依据。在知识的演化过程中,数据既是产生信息、知识、智慧的基础,又同时贯穿于其中。进入信息化时代,遇到的最大难题不是信息不足,而是信息孤岛的问题,只有实现大数据的共享和规范管理,才能破解这一难题。
曾几何时,数据是人类用于识别环境的计数工具,对其精确性的关注似乎仅限于科学研究领域。进入信息化时代,我们每一个人都明显感受到与信息相关的数据无处不在。可以说,我们自身在不断产生各种数据的同时,数据也在极大地影响我们。
在数据的发展历程中有过两次革命。第一次数据革命是近代科学诞生之时,实现了数据与科学研究的融合,数据在科学研究中的基础地位得到确立。对研究过程和结果赋予精确化的诉求,是近代科学的基本特征之一。在以数据为依据的研究范式中,数据的可靠性和准确性代表了研究的精确性,人们甚至将以数据为依据的实证研究作为判断“科学”与“伪科学”的标准。
随着科学和技术的发展,数据的形式和内涵也在不断变化和发展。除观测数据、实验数据、理论数据、统计数据、模拟数据等外,图、表、文字均被纳入数据行列,形成了结构化数据和非结构化数据的多元化数据形式;信息技术的发展导致从数据匮乏向“数据丰富,理论匮乏”方向转变,数据产生的速度和规模急剧发展;数据所蕴含的信息远远超出其工具性和依据性特征,形成可以从中挖掘出新知识的大数据。与统计数据相比,大数据强调的是全部样本;与科学数据的精确性相比,大数据允许存在一定范围的不准确性;与科学范式的因果关系相比,大数据通过关联性寻求自然和社会的变化规律。因此,大数据引发了第二次数据革命,它不仅改变着科学研究范式,实现社会科学研究的定量化,也将促使经济、社会、军事等所有社会领域产生巨大的变革。
在科学研究方面,通过遥感装置、感应器、计算机收集数据或模拟方法获取的密集型数据,经过计算机软件处理,产生的信息/知识被存储在计算机中,科学家们只需在后台利用数据管理和统计的方法对数据进行处理、分析,获取知识,形成以大数据为基础的密集型科学,成为格雷提出的数据驱动科学的第四种科学范式。正如EPJ Data Science杂志所指出的,21世纪面临的数据驱动科学已成为传统假说驱动科学方法的补充,这种进化伴随科学范式从还原主义(简化)到复杂系统科学转变的变革。
大数据可能导致社会科学研究的革命,促进定量研究的深入。大数据突破了自然科学和社会科学的研究界限,实现了数据的可通约性,通过数据沟通了不同学科的资源。哥伦比亚大学沃茨博士通过研究发现,大数据对极其复杂的人类行为的社会学研究起到了极其重大的作用,通过网络数据,大量个人或很小组织的真实行为通过计算机以数据形式被记录下来,这些数据为人类行为研究提供了极其丰富的可靠信息,避免了研究者认知的偏见、感知的误差和框架的歧义。
大数据对经济、社会、人类日常生活产生的影响不仅仅限于技术层面,对于管理理念、运作方式也都将产生巨大的影响。“数据驱动的社会管理”就是在社会管理中实施的一种新型管理模式,无论是政府还是组织机构,数据收集和分析已经成为基层管理部门的基本要求,根据数据分析结果制定政策和法规,将社会管理从事后处罚转向事前防备,在医疗健康、国土安全、智慧城市建设、防范和打击恐怖活动、社会治安、治理社会腐败等方面发挥着重要作用。20世纪美国的警务管理模式CompStat是利用大数据对社会治安进行管理并取得良好成效的成功范例。利用地方各种传感器收集的大数据和通过互联网搜索关键词,疾病控制部门可以预测和判断某地的流行病爆发的情况。商务智能实现了从数据到知识的挑战和跨越,“决策支持系统”更是以数据和信息为主要来源,等等。
无论是“数据驱动的社会管理”还是“决策支持系统”,数据的获取和对数据的挖掘都至关重要,对收集到的各种数据,在后台进行分析,建立模型,利用云计算等计算手段,为制定政策、法律和决策提供技术支撑。各国已经意识到大数据的重要性,将其视为与能源同等重要的资源。2012年3月29日,代表美国政府的白宫科技政策办公室发布了《大数据研究和发展计划》,并成立了“大数据高级指导小组”,将大数据技术革命带来的机遇和挑战提升到国家战略层面。
与传统数据相比,大数据的资源性特征尤为突出,成为各国重视开发大数据的依据。在知识的演化过程中,数据既是产生信息、知识、智慧的基础,又同时贯穿于其中。进入信息化时代,遇到的最大难题不是信息不足,而是信息孤岛的问题,只有实现大数据的共享和规范管理,才能破解这一难题。
在移动网络、云计算和其他技术的支持下,大数据迅猛发展,分析数据的技术不断创新,第二次数据革命悄然发生。大数据与任何一项新技术一样,在推动社会变革的同时也造成了社会风险,例如,个人隐私、数据的客观性和准确性、大数据的滥用等问题,已经遍及科学研究、社会管理、医疗保健、商务智能等众多领域。
大数据与其他技术的不同在于其虚拟性,其隐蔽性和渗透性更加突出。这对个人、组织、国家甚至整个世界都可能带来负面影响。因而,对其进行更深层次的伦理学和哲学反思尤为重要。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】互联网、机会、运营、关键词、账户、数字化、后台、客户、成本、网络、数据分析、底层逻辑、市场推广、数据反馈、 ...
2026-05-14在Python数据分析中,Pandas作为核心工具库,凭借简洁高效的数据处理能力,成为数据分析从业者的必备技能。其中,基于两列(或多 ...
2026-05-14 很多人把统计学理解为“一堆公式和计算”,却忽略了它的本质——一门让数据“开口说话”的科学。真正的数据分析高手,不是会 ...
2026-05-14在零售行业存量竞争日趋激烈的当下,客户流失已成为侵蚀企业利润的“隐形杀手”——据行业数据显示,零售企业平均客户流失率高达 ...
2026-05-13当流量红利消退、用户需求日趋多元,“凭经验决策、广撒网投放”的传统营销模式早已难以为继。大数据的崛起,为企业营销提供了全 ...
2026-05-13 许多数据分析师精通Excel函数和SQL查询,但当面对一张上万行的销售明细表,要快速回答“哪个地区销量最高”“哪款产品增长最 ...
2026-05-13【专访摘要】本次CDA持证专访邀请到拥有丰富物流供应链数据分析经验的赖尧,他结合自身在京东、华莱士、兰格赛等企业的从业经历 ...
2026-05-12在手游行业存量竞争日趋激烈、流量成本持续高企的当下,“拉新”早已不是行业核心痛点,“留存”尤其是“付费留存”,成为决定手 ...
2026-05-12 很多数据分析师掌握了Excel函数、会写SQL查询,但当被问到“数据从哪里来”“数据加工有哪些步骤”“如何使用分析工具连接数 ...
2026-05-12用户调研是企业洞察客户需求、优化产品服务、制定运营策略的核心前提,而调研数据的可靠性,直接决定了决策的科学性与有效性。在 ...
2026-05-11在市场竞争日趋激烈、流量成本持续攀升的今天,企业的核心竞争力已从“获取流量”转向“挖掘客户价值”。客户作为企业最宝贵的资 ...
2026-05-11 很多数据分析师精通Excel单元格操作,熟练应用多种公式,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质 ...
2026-05-11在互联网运营、产品优化、用户增长等领域,次日留存率是衡量产品价值、用户粘性与运营效果的核心指标,更是判断新用户是否认可产 ...
2026-05-09相关性分析是数据分析领域中用于探究两个或多个变量之间关联强度与方向的核心方法,广泛应用于科研探索、商业决策、医疗研究、社 ...
2026-05-09 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-05-09在数据驱动运营的时代,指标是连接业务目标与实际行动的核心桥梁,是企业解读业务现状、发现问题、预判趋势的“量化标尺”。一套 ...
2026-05-08在存量竞争日趋激烈的商业时代,“以客户为中心”早已从口号落地为企业运营的核心逻辑。而客户画像作为打通“了解客户”与“服务 ...
2026-05-08 很多数据分析师每天与Excel打交道,但当被问到“什么是表格结构数据”“它和表结构数据有什么区别”“表格结构数据有哪些核 ...
2026-05-08在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07