京公网安备 11010802034615号
经营许可证编号:京B2-20210330
从经验思维到实证思维的转变
比起“大数据”,我更喜欢“数据科学”的提法,这是因为:第一,在今后的分享中,我会更偏向于从技术层面探讨如何利用数据优化管理决策;第二,数据量的大小固然重要,然而数据能否提升管理水平,更取决于管理者能否从经验思维转变为科学思维,或者更确切地说,转变为实证思维。所以我想在这管理学家的领地上多谈谈科学。

中国人多以经验思维为主,其特点是判断多而论证少。即便有论证,也是基于逻辑的辩证多,基于数据的实证少。只要留意一下每天的新闻,就会发现经验思维的例子比比皆是。拿一条新闻 “北京中秋前进入最堵一周” 来说,媒体的普遍判断是中秋前堵车是因为人们节前纷纷跑到北京去送礼。这一判断符合我们的经验,似乎也符合逻辑,但是却恰恰缺乏实证。若从实证的角度验证这一判断,我们要回答以下两个问题:为什么说这是最堵的一周?如何证明这最堵的一周是由人们从外地到北京送礼造成的?
要从实证的角度来回答第一个问题,首先要确定“堵”的衡量方式,比如说是以平均车速,或者平均车流量;“平均”又是在哪些时段上,哪些地区内,针对哪些车型(是否包括公交车)。然后,我们需要足够多年份的每周“堵车”数据来支持我们的说法。最后,我们还需要收集尽可能多的控制变量数据,譬如每年中秋与国庆的间隔天数、天气状况、重要会议及活动、道路施工情况、北京的拥车情况、街道面积、高速里程、地铁线路演变等等,因为这些因素都有可能影响堵车并影响我们对“中秋前是最堵一周”的证明。
可见,要从数据科学的角度很好地回答第一个问题并不容易,而要实证地回答第二个问题就更困难了。我们需要知道:每周有多少外地车辆进北京?是否中秋前的一周外地车最多?这些外地车辆是不是来送礼的?来送礼的外地车辆都在什么时间,什么地点出现?当他们出现时,是否直接观测到了拥堵?如果没有直接观测到来送礼的外地车辆造成了拥堵,是否是本地车辆为了避开这些来送礼的外地车造成了其他时间,其他地点的拥堵?
从实证的角度做了这番思考,我们会发现,一个凭经验得出的判断竟然如此难以证明。其实,如果我们尝试用数据科学的方法论来审视一下我们在管理中所做的判断,我们同样会吃惊于很多判断极度缺乏实证依据。而这种将经验思维转变为实证思维所带来的阵痛与震撼,却是我们通向数据科学时代,通向数据驱动的管理决策必经的关键一步。
这种从经验思维到实证思维的转变,不仅是管理观念的转变,还会带来操作层面和技术层面上的转变。从对“北京中秋前进入最堵一周”的实证思考,我们实际上也对哪些数据会有用,哪些数据需要进一步收集,数据分析中哪些因素需要得到控制等等,有了更清晰的认识。并且,在对收集到的数据进一步做实证分析的过程中,我们的原有认识有可能会被颠覆,从而成为展开新一轮实证思考和数据收集的起点。比如说,通过对各主要路口的监控视频进行分析,我们可能并没有发现外来车辆的增加,但是却发现本地公车牌照的出现频率比往常要高。如果有这样的发现,我们对拥堵成因的判断就要修正,进一步的数据收集重点也会随之转到公车使用上了。
尤为重要的是,从经验思维到实证思维的转变,还能帮助我们找到更为高效和低成本的解决方案。还是拿堵车作为例子,基于经验思维的判断,往往会导致兴师动众、社会成本很高的解决方案,譬如限制外来车辆入京。而基于数据和实证分析的解决方案可能会是提高某些时段,某些区域内的停车费用;或是调节相应时段区域内的左转和右转限制及红绿灯的间隔等。相比之下,这样做的成本要小很多。
一直在用堵车说事,这看似只是政府公共管理的范畴,但其实解决堵车问题对企业的运营和营销也会有影响。中秋节大家都要吃月饼,而这些年来,哈根达斯冰淇淋月饼已经成为一线城市中月饼的新宠儿。在促进哈根达斯月饼成功的因素中,其团队运用实证思维来解决堵车问题也功不可没。一开始,团队选在离高速公路出口很近的地点建立临时月饼领取点。从经验思维的角度,这似乎很有道理,因为方便了消费者。但是团队很快发现这样做导致了交通阻塞,不仅降低了顾客的满意度,也招来了政府交通部门的抱怨。之后其团队从实证思维的角度,通过对顾客流量的时间空间分布的分析,优化了领取点的设置、产品配送和领取流程。顾客的体验和忠诚度自然也提升了。
令人高兴的是,实证思维和基于数据的管理决策观念正慢慢地深入人心。大家可能注意到临近中秋时,不少网友吐槽“五仁月饼”难吃,并将其炒成了一个热门话题。然而媒体朋友们并非人云亦云,而是通过问卷调查、销量统计的方法为“五仁月饼”正了名。据9月18日《新京报》报道,消费者对五仁月饼评价排名第二,销量良好,甚至部分店铺都脱销了。媒体需要这样的实证思维,企业管理者也需要这样的实证思维。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
CDA数据分析师 出品 作者:李诗怡 一、数据分析四大思维 1. 对比思维:没有对比就没有分析 核心观点:单独一个数字没有意义,有 ...
2026-10-05Kimball 是方法,星型模型是它产出的形状。 很多人把"Kimball vs 星型模型"当成一道选择题——这本身就是个误会:Kimball 是动词 ...
2026-10-05写在开头 老板在微信上甩来一句: "帮我看下为什么销量跌了。" ” 你回工位,打开 SQL,开始写。查订单表、拉近三个月、按 ...
2026-10-03CDA数据分析师 出品 作者:李诗怡 1. 事实表 vs 维度表 对比维度 事实表 维度表 核心问题 记录“业务发生了什么事” 描述 ...
2026-10-02做数据聚合时,PySpark的groupBy()确实能完成统计,这也是它的本职工作。但它有一个根本性局限:每一组数据,最终只能返回一行 ...
2026-10-01热力地图是数据可视化中极具辨识度与实用性的空间分析图表,结合地理空间维度与数据密度特征,通过颜色深浅、色阶渐变直观展示数 ...
2026-09-30 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-09-30同样是“银行数据岗”,在国有大行总行数据中心、在一家城商行的零售部、在银行系金融科技子公司、在保险公司,工作内容、成长节 ...
2026-09-29在数据分析与统计学研究中,数据往往不是独立存在的,不同变量之间普遍存在相互关联、相互影响的关系。相关性统计分析是挖掘变量 ...
2026-09-29 导读:大多数人只把 dataclasses 当成偷懒工具,用来少写 __init__、__repr__ 这类魔法方法。但它的能力远不止于此。本文带 ...
2026-09-29 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-09-29在MySQL数据库运维与业务开发中,行业普遍存在“数据达到千万级就必须分表”的说法。但在实际生产环境中,千万条数据并不是强制 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 5W1H 分析法 定义:经典系统性思维框架,通过六个核心维度对问题进行全方位拆解与剖析,确 ...
2026-09-28 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-09-28CDA数据分析师 出品 作者:李诗怡 1. 用户标签体系 定义: 通过一系列高度精炼的特征标识,对用户属性、行为与偏好进行量化刻画 ...
2026-09-24Pandas是Python生态中用于表格数据处理的核心库,广泛应用于数据清洗、统计运算、报表输出、数据分析建模等场景。在处理极大数值 ...
2026-09-24随着数字经济快速发展,数据已成为核心生产要素,各行各业的业务沉淀、用户行为、设备运行、市场交易均产生海量数据。数据处理作 ...
2026-09-24 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-09-24在时序数据分析中,大部分业务数据并非持续平稳变化,而是会在某些时间节点出现突然抬升、断崖下跌、趋势反转、波动异变等现象, ...
2026-09-23在统计学与数据分析中,研究多组数据差异最常用的方法为单因素方差分析与事后多重比较。很多数据分析初学者容易混淆两者功能,认 ...
2026-09-23