京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据会改变人们的思维
一讲到大数据,通常都会提到4个V:量大(Volume),积累速度高(Velocity),数据的产生多源化(Variety),数据笼统噪音大(Voracity)。然而,这些只是对大数据在互联网时代超高速增长现象的描述。大数据真正的意义和价值是它改变了我们的思维方式。这就是大数据思维。
大数据思维能使我们在决策过程中超越原有思维框架的局限。每个人都是依据自己对现实的认识和判断而不是现实本身作出行动决策的。以数据为基础的智能决策有两个步骤。第一是对事物的理解和判断,第二是作出行动决策(不行动也是一种决策)。行动决策会受到决策者价值取向的影响。比如,二次大战末美国打到日本沿岸并调集了比攻打德国时诺曼地登陆更多的军舰云集太平洋准备对日本本土发起攻击。根据对攻占几个日本岛屿所造成伤亡数据的分析,美军预测攻占日本本土将要付出50万美军伤亡的代价。在这个判断的基础上,美国总统杜鲁门做出了向日本投原子弹的决定。结果是减少了美军的伤亡但造成了几十万日本平民的死亡和持续至今的辐射危害,其价值取向是很清楚的。
人们对事物的理解和判断会受制于自身思维框架的局限。一个物理学家在分析一件事物时,会很自然地应用物理定律来思考、理解和判断。所用的概念和语言也会有物理特征(时间、速度、场、重量、质量、作用力、反作用力等等)。一个社会科学家在分析一件事物时,脑子里出现的框架是人际关系、社会地位、历史背景、社会效益等等。所用的概念和语言带有社会人文特征。搞理论工作的和搞实际工作的思维框架也很不同,前者重视逻辑性、系统性,而后者更重视时间性和可行性。即使是同行业的人也会因年龄、经历、环境、学历不同而产生不同的思维框架。当同一现象和信息进入不同人的脑子里时,它会被不同的思维网路过滤、不同的思维方式处理,最后的结果是对同一现实产生不同解读。没有一个思维框架,我们无法理解和判断一件事物。但思维框架本身又对我们的认知产生了一个很难逾越的局限。
大数据思维不是从某个人的思维框架出发,而是让海量数据碰撞,寻找相关性,先看到结果再分析原因。这就冲破了原有思维框架的局限。比如,美国一家零售商在对海量的销售数据处理中发现每到星期五下午,啤酒和婴儿尿布的销量同时上升。通过观察发现星期五下班后很多青年男子要买啤酒度周末而这时妻子又常打电话提醒丈夫在回家路上为孩子买尿布。发现这个相关性后,这家零售商就把啤酒和尿布摆在一起,方便年轻的爸爸购物,大大提高了销售额。
大数据思维可以引发城市管理的新方法。自从美国大使馆每天公布PM2.5指数以后,城市空气污染的问题得到了中国各个城市政府和市民的重视。每天PM2.5检测数据的采集成为环境保护和管理的一个重要任务。如果一个统计学家按照原有思维框架来设计检测数据采集,他会从统计学原理出发在市区有代表性的不同地点定时采集和上报数据。其结果是数据量有限,费用高,检测覆盖率和准确率低。应用大数据思维,某市环保部门考虑将上万个手持检测仪发放给散居各处的市民检测并通过手机上传数据。通过手机定位,环保部门可以确定每个数据的测量地点和时间,大大提高数据采集的覆盖面和精确度。
大数据思维可以对历史数据的分析提供新思路。中国人讲究作学问要“读万卷书,行万里路”。用大数据思维,读万卷书在今天并非难事。美国的国会图书馆正在将藏书全部数码化。以后通过电脑“看书”搜索关键词,分析相关字条和数据将会非常容易,读万卷书可能只是几小时的“小任务”。美国匹兹堡大学公共卫生学院将记录在报纸、报告、微缩胶片上美国各地自1888年以来有关传染病发生和死亡的多元、碎片、海量的数据收集、整理并数码化。通过数据建模和分析,把一百多年的历史“死”数据变活,建立了1888至2010年美国50多种传染病电子数据档案库。用历史数据证明了免疫苗的发明和使用避免了一亿以上的美国人死于传染病。(见下图)
大数据思维能帮助开创新的商业模式。在美国出现的Uber打车服务和后来中国兴起的滴滴出行(原滴滴打车)是大数据思维产生的经典020(网上网下完美结合)新型商业模式。智能手机在移动互联网时代的普及使实时定位的数据传递和信息沟通成为可能。它为乘客和司机之间的商业交换提供了一个崭新的平台,改变了传统的电话叫车或路边招车,降低了沟通成本和空驶率,极大地节省了司机乘客双方的资源和时间。源源不断的乘车交易和时间地点的电子数据在高速地积累和储存。数据科学家们可以通过对海量数据的分析寻找规律以提高和改进乘客打车出行的体验,找到新的商机和推出新的服务。
大数据思维的核心是要意识到我们已经生活在一个互联网几乎无处不在的世界。互联网将各种信息仪器(手机、电脑、传感器、相机、摄像头、等等)联为一体(物联网),数码化的数据和信息在这个庞大的网上时时刻刻地传递、储存和积累。数码化数据可以被高速处理,而且已经成为新型的、甚至是最有价值的生产资料。矿物可以冶炼成金属、原油可以提炼出汽油,如何将数据加工成信息、产生智能、解决过去无法解决的老问题和开创新的管理和商业模式以产生新价值是对我们的挑战。而迎接这一挑战的第一步就是要懂得和理解大数据思维。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在机器学习建模中,决策树模型因其结构直观、易于理解、无需复杂数据预处理等优势,成为分类与回归任务的首选工具之一。而变量重 ...
2026-03-17在数据分析中,卡方检验是一类基于卡方分布的假设检验方法,核心用于分析分类变量之间的关联关系或实际观测分布与理论期望分布的 ...
2026-03-17在数字化转型的浪潮中,企业积累的数据日益庞大且分散——用户数据散落在注册系统、APP日志、客服记录中,订单数据分散在交易平 ...
2026-03-17在数字化时代,数据分析已成为企业决策、业务优化、增长突破的核心支撑,从数据仓库搭建(如维度表与事实表的设计)、数据采集清 ...
2026-03-16在数据仓库建设、数据分析(尤其是用户行为分析、业务指标分析)的实践中,维度表与事实表是两大核心组件,二者相互依存、缺一不 ...
2026-03-16数据是CDA(Certified Data Analyst)数据分析师开展一切工作的核心载体,而数据读取作为数据生命周期的关键环节,是连接原始数 ...
2026-03-16在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09