京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据的颠覆性 已渗入边缘行业
在银河帝国系列科幻小说中,数学家哈里·谢顿开创了“心理史学”,他能够运用数学公式准确预测人类的未来,作者艾萨克·阿西莫夫凭借其丰富的想象力被全球读者誉为“神一样的人”。如今,小说里预知未来的桥段在某种程度上已经实现,不过不是凭借“心理史学”,而是归功于“大数据”。
大数据是近几年的热词,但从根源上讲其方法论不过是传统的统计学。只是
在银河帝国系列科幻小说中,数学家哈里·谢顿开创了“心理史学”,他能够运用数学公式准确预测人类的未来,作者艾萨克·阿西莫夫凭借其丰富的想象力被全球读者誉为“神一样的人”。如今,小说里预知未来的桥段在某种程度上已经实现,不过不是凭借“心理史学”,而是归功于“大数据”。
大数据是近几年的热词,但从根源上讲其方法论不过是传统的统计学。只是随着人类的信息被数字化,数据越来越多,再加上存储与计算能力逐步提高,此时把统计学和庞大的数据融合在一起便对很多产业产生了颠覆效果。
中国社科院经济与政治研究所副所长何帆就是个大数据的推崇者,他相信大数据可以实现很多闻所未闻的事情。比如,社科院可以通过一个人的信用卡消费记录预测这个人在5年内的离婚概率。
不过,何帆并不认同阿西莫夫的观点,他认为未来的变化是无法预测的,在大数据时代,真正能预测的是个人的行为。“计算机比我们了解自己,可以预知每个人未来会做出怎样的决策。这正是商界为大数据疯狂的原因,准确预测消费者行为将带来全新的发展机遇。”
如今,大数据已经被应用在金融、科技和零售等热门领域,但据何帆介绍,其实很多看似被大数据边缘化的传统行业更早接受了大数据的挑战与变革。
品酒界:预测世纪最佳葡萄酒
品酒界是最早受到大数据影响的行业之一。
传统的品酒是由专业的品酒大师完成,这些人通常天赋异禀,嗅觉与味觉超常,而且后天训练有素。但这一垄断局面后来被普林斯顿大学的一位英语学教授打破了。这位教授尝试用统计分析的方法替代传统的物理品酒法,他收集了降雨量、平均气温、土壤成分等影响葡萄酒品质的各类数据,并根据历年葡萄酒的品质挖掘其中的联系。凭此方法,他成功预测了世纪最佳葡萄酒。
“这就是大数据思维,现在传统的品酒师不敢轻易对葡萄酒的品质做判断了,都要先查看大数据的预测再下结论。”何帆说。
体育界:挑选潜在运动之星
不仅是选酒,选人的决策同样受到大数据的影响。
电影《点球成金》真实反映了大数据对固有的运动员挑选规则的挑战。在电影中,比利·比恩研究出一套“棒球统计学”,对球员的防御率、胜投数、打击率、长打率、全垒打数、打点数等几十类数据进行统计与分析,借此预测球员的潜能。与固有的根据经验对球员进行主观判断相比,数据统计的方式更加精确与可靠,从而打破常规发现了潜在棒球之星。
在现实的体育界,大数据已经应用在各项运动中。2013年年末,美国NBA开始在所有球场中安装体感追踪技术,记录并追踪篮球和球员的运动。这一系统将提供持续的数据流和全面的统计数据,包括速度、距离、球员之间间隔以及控球情况等,以实现目标性更强的分析。
在大数据面前,几乎每一个球员都面临优势与局限被暴露无遗的状况。比如,通过统计姚明在篮下接球、运球失误的次数比得知,姚明右手接球时通常能运球三次,左手接球则只能运球两次。这样的规律就告诉防守人,要想解除姚明对篮下的威胁,就要把他限制在远离篮筐的区域,让他必须运球三次以上才来到篮下,这样往往就会失误。
博彩业:远离顾客忍无可忍的输钱底线
在很多高级赌场,顾客进门时需要办理一张电子磁卡,在登记性别、年龄、民族、职业等基本信息时,他们便开始置于大数据的监测之下。根据顾客的数据信息,系统会立刻将其与数据库中的样本进行匹配,推断出顾客的最大消费能力、消费时间极限等行为特点。
“每个人无论多有钱,都有一个痛苦点,当输的钱超过一定数目,很可能再也不踏进这个赌场一步。而大数据带给传统赌场的是一个最好的选择——通过预测顾客的痛苦点,在那之前让他们住手。”
何帆举例说,如果一个35岁的中国男性土豪走进了赌场,大数据会预测到这个人的痛苦点大概是1万美金,通过CCTV和各桌的监控,当他输到9800美元的时候,便会有年轻貌美的公关经理主动上前攀谈,缓和他的情绪,引导其到餐饮、休闲等其他区域消费。而保留顾客的最后一点耐心和希望,也会促成他们的再次消费。
在何帆看来,消费者在享受精准服务时,自己已经在大数据的监控下了,大数据不仅可以帮助商家榨干消费者当下可以消费的最后一分钱,还能保留再次压榨他们的可能。
医学界:预防在疾病发生之前
医学领域很早就应用了大数据思维。在细菌被发现之前,一位医生意识到如果从停尸房回来后做接生手术,死亡率就会很高。他认定这之间存在某种联系,于是建议大家用肥皂洗手后再手术。尽管当时并没有人理解洗手与死亡率下降相关的原因,但人们还是通过信息发现了其中的联系。
“知其然,不知其所以然,这正是大数据的规律,”何帆说,“美剧《豪斯医生》的医学顾问就是一名行政医学的代表人物,相比于传统的病理学问诊方法,行政医学强调的是病症,而不是病因,这就是用大数据说话。”
在欧美医学界,大数据的思维被很好地延续了下来。创立于1863年的美国梅奥医院(Mayo Clinic)在为患者诊病时,除了凭借医生的技术和经验,还要依靠医院150年积累的临床统计与实践经验的大数据。
据介绍,如果把梅奥数据库中头疼这一单独症状可能引发的疾病以5号字打印出来,能铺满一个400多平米的房间,基本不会遗漏任何一种可能的疾病。这不仅可以帮助医生判断病人当下的健康状况,还可以预测潜在病痛的发生趋势,从而提出有针对性的保健方案。
影视圈:内容由观众决定
从导演想拍什么到观众想看什么,影视界在不断抬高观众的地位,以此获得较高的市场回报,而此时大数据成了判断观众兴趣的绝佳途径。以喜好最难琢磨的幼童观众为例,传统的沟通方式完全无法进行,制作方只能凭借经验与推测进行创作,但大数据的出现让幼童心理活动的获知成为可能。
“美国最早采用大数据制作的儿童节目是《芝麻街》,制作方每制作一个新的动画片段都会让大量的小朋友试看,同时在屏幕旁随机出现一些卡通图案。虽然无法与幼童沟通,但当小孩总是分神去看屏幕旁的卡通图案时,制作方就认为这段卡通式孩子没有看懂、或不吸引人的。制作方于是将这些数据统计起来,分析对比后对影片加以修改。”何帆表示,这就是最基本的大数据对影视制作的影响。
此外,这几年流行的《天线宝宝》也得益于大数据的应用。尽管在成人眼中,每句话、每个动作重复3遍是近乎弱智的表现形式,但就是这个卡通片让全世界的小孩子看得目不转睛。通过大数据的研究发现,在儿童的心理世界,重复是学习和娱乐的主要认知规律,而三遍恰到好处,《天线宝宝》正是大胆使用了这一结论,从而成功打造出一部打破常规的儿童卡通片。
还有更多的传统行业正在无形间被大数据颠覆,对于这些大数据应用的非主流领域,其带来的冲击或许更强烈,逼迫从业者进行产业变革与创新。当然,这也致使某些难以接受统计逻辑与思维的从业者面临失业的风险。
另一方面,何帆认为,行业在享受大数据变革的同时,消费者的隐私正变得无处可藏。大数据的源头正是普通的消费者,购物记录、乘车记录、投资记录、甚至是生理记录,每个人的生活都在被数据化,都在某些人的监测之中。
“被大数据改变的行业越多,人们要让渡的隐私越多,这正是大数据在未来要面对的其中一个危机。”何帆说。
中国社科院经济与政治研究所副所长何帆就是个大数据的推崇者,他相信大数据可以实现很多闻所未闻的事情。比如,社科院可以通过一个人的信用卡消费记录预测这个人在5年内的离婚概率。
不过,何帆并不认同阿西莫夫的观点,他认为未来的变化是无法预测的,在大数据时代,真正能预测的是个人的行为。“计算机比我们了解自己,可以预知每个人未来会做出怎样的决策。这正是商界为大数据疯狂的原因,准确预测消费者行为将带来全新的发展机遇。”
如今,大数据已经被应用在金融、科技和零售等热门领域,但据何帆介绍,其实很多看似被大数据边缘化的传统行业更早接受了大数据的挑战与变革。
品酒界:预测世纪最佳葡萄酒
品酒界是最早受到大数据影响的行业之一。
传统的品酒是由专业的品酒大师完成,这些人通常天赋异禀,嗅觉与味觉超常,而且后天训练有素。但这一垄断局面后来被普林斯顿大学的一位英语学教授打破了。这位教授尝试用统计分析的方法替代传统的物理品酒法,他收集了降雨量、平均气温、土壤成分等影响葡萄酒品质的各类数据,并根据历年葡萄酒的品质挖掘其中的联系。凭此方法,他成功预测了世纪最佳葡萄酒。
“这就是大数据思维,现在传统的品酒师不敢轻易对葡萄酒的品质做判断了,都要先查看大数据的预测再下结论。”何帆说。
体育界:挑选潜在运动之星
不仅是选酒,选人的决策同样受到大数据的影响。
电影《点球成金》真实反映了大数据对固有的运动员挑选规则的挑战。在电影中,比利·比恩研究出一套“棒球统计学”,对球员的防御率、胜投数、打击率、长打率、全垒打数、打点数等几十类数据进行统计与分析,借此预测球员的潜能。与固有的根据经验对球员进行主观判断相比,数据统计的方式更加精确与可靠,从而打破常规发现了潜在棒球之星。
在现实的体育界,大数据已经应用在各项运动中。2013年年末,美国NBA开始在所有球场中安装体感追踪技术,记录并追踪篮球和球员的运动。这一系统将提供持续的数据流和全面的统计数据,包括速度、距离、球员之间间隔以及控球情况等,以实现目标性更强的分析。
在大数据面前,几乎每一个球员都面临优势与局限被暴露无遗的状况。比如,通过统计姚明在篮下接球、运球失误的次数比得知,姚明右手接球时通常能运球三次,左手接球则只能运球两次。这样的规律就告诉防守人,要想解除姚明对篮下的威胁,就要把他限制在远离篮筐的区域,让他必须运球三次以上才来到篮下,这样往往就会失误。
博彩业:远离顾客忍无可忍的输钱底线
在很多高级赌场,顾客进门时需要办理一张电子磁卡,在登记性别、年龄、民族、职业等基本信息时,他们便开始置于大数据的监测之下。根据顾客的数据信息,系统会立刻将其与数据库中的样本进行匹配,推断出顾客的最大消费能力、消费时间极限等行为特点。
“每个人无论多有钱,都有一个痛苦点,当输的钱超过一定数目,很可能再也不踏进这个赌场一步。而大数据带给传统赌场的是一个最好的选择——通过预测顾客的痛苦点,在那之前让他们住手。”
何帆举例说,如果一个35岁的中国男性土豪走进了赌场,大数据会预测到这个人的痛苦点大概是1万美金,通过CCTV和各桌的监控,当他输到9800美元的时候,便会有年轻貌美的公关经理主动上前攀谈,缓和他的情绪,引导其到餐饮、休闲等其他区域消费。而保留顾客的最后一点耐心和希望,也会促成他们的再次消费。
在何帆看来,消费者在享受精准服务时,自己已经在大数据的监控下了,大数据不仅可以帮助商家榨干消费者当下可以消费的最后一分钱,还能保留再次压榨他们的可能。
医学界:预防在疾病发生之前
医学领域很早就应用了大数据思维。在细菌被发现之前,一位医生意识到如果从停尸房回来后做接生手术,死亡率就会很高。他认定这之间存在某种联系,于是建议大家用肥皂洗手后再手术。尽管当时并没有人理解洗手与死亡率下降相关的原因,但人们还是通过信息发现了其中的联系。
“知其然,不知其所以然,这正是大数据的规律,”何帆说,“美剧《豪斯医生》的医学顾问就是一名行政医学的代表人物,相比于传统的病理学问诊方法,行政医学强调的是病症,而不是病因,这就是用大数据说话。”
在欧美医学界,大数据的思维被很好地延续了下来。创立于1863年的美国梅奥医院(Mayo Clinic)在为患者诊病时,除了凭借医生的技术和经验,还要依靠医院150年积累的临床统计与实践经验的大数据。
据介绍,如果把梅奥数据库中头疼这一单独症状可能引发的疾病以5号字打印出来,能铺满一个400多平米的房间,基本不会遗漏任何一种可能的疾病。这不仅可以帮助医生判断病人当下的健康状况,还可以预测潜在病痛的发生趋势,从而提出有针对性的保健方案。
影视圈:内容由观众决定
从导演想拍什么到观众想看什么,影视界在不断抬高观众的地位,以此获得较高的市场回报,而此时大数据成了判断观众兴趣的绝佳途径。以喜好最难琢磨的幼童观众为例,传统的沟通方式完全无法进行,制作方只能凭借经验与推测进行创作,但大数据的出现让幼童心理活动的获知成为可能。
“美国最早采用大数据制作的儿童节目是《芝麻街》,制作方每制作一个新的动画片段都会让大量的小朋友试看,同时在屏幕旁随机出现一些卡通图案。虽然无法与幼童沟通,但当小孩总是分神去看屏幕旁的卡通图案时,制作方就认为这段卡通式孩子没有看懂、或不吸引人的。制作方于是将这些数据统计起来,分析对比后对影片加以修改。”何帆表示,这就是最基本的大数据对影视制作的影响。
此外,这几年流行的《天线宝宝》也得益于大数据的应用。尽管在成人眼中,每句话、每个动作重复3遍是近乎弱智的表现形式,但就是这个卡通片让全世界的小孩子看得目不转睛。通过大数据的研究发现,在儿童的心理世界,重复是学习和娱乐的主要认知规律,而三遍恰到好处,《天线宝宝》正是大胆使用了这一结论,从而成功打造出一部打破常规的儿童卡通片。
还有更多的传统行业正在无形间被大数据颠覆,对于这些大数据应用的非主流领域,其带来的冲击或许更强烈,逼迫从业者进行产业变革与创新。当然,这也致使某些难以接受统计逻辑与思维的从业者面临失业的风险。
另一方面,何帆认为,行业在享受大数据变革的同时,消费者的隐私正变得无处可藏。大数据的源头正是普通的消费者,购物记录、乘车记录、投资记录、甚至是生理记录,每个人的生活都在被数据化,都在某些人的监测之中。
“被大数据改变的行业越多,人们要让渡的隐私越多,这正是大数据在未来要面对的其中一个危机。”何帆说。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01在时间序列预测任务中,LSTM(长短期记忆网络)凭借对时序依赖关系的捕捉能力成为主流模型。但很多开发者在实操中会遇到困惑:用 ...
2025-12-01引言:数据时代的“透视镜”与“掘金者” 在数字经济浪潮下,数据已成为企业决策的核心资产,而CDA数据分析师正是挖掘数据价值的 ...
2025-12-01数据分析师的日常,常始于一堆“毫无章法”的数据点:电商后台导出的零散订单记录、APP埋点收集的无序用户行为日志、传感器实时 ...
2025-11-28在MySQL数据库运维中,“query end”是查询执行生命周期的收尾阶段,理论上耗时极短——主要完成结果集封装、资源释放、事务状态 ...
2025-11-28在CDA(Certified Data Analyst)数据分析师的工具包中,透视分析方法是处理表结构数据的“瑞士军刀”——无需复杂代码,仅通过 ...
2025-11-28在统计分析中,数据的分布形态是决定“用什么方法分析、信什么结果”的底层逻辑——它如同数据的“性格”,直接影响着描述统计的 ...
2025-11-27在电商订单查询、用户信息导出等业务场景中,技术人员常面临一个选择:是一次性查询500条数据,还是分5次每次查询100条?这个问 ...
2025-11-27