
数据分析八大禁忌
大家都对这种东西嗤之以鼻对不对?作为接受过高等教育的我们怎么会信这些命理风水的东西呢,比如床不能对着电视机,开玩笑,老祖宗的年代有电视机吗?躺着看电视才享受呢。对于这种东西,陈老师一开始也是拒绝的,直到有一天半夜起床上厕所,看到电视机里自己的影子以为撞见鬼吓得尿了一裤裆,才深刻感慨祖先智慧的伟大。
所以禁忌这种东西,都是借鬼神之言,行人间之事。特别是面对那些初出茅庐的小伙子,还真的编点鬼怪故事恐吓一下他们的好奇心,才会避免他们走更多弯路,正如每个老奶奶都养了一只吓唬孙子的大灰狼一样。
在数据分析领域,也有这样的行为禁忌,站在支持业务的角度,数据分析工作可分为三类:
1.事前:预测
2.事中:监控
3.事后:评估
我们一类一类看一下,办事的时候有哪些禁忌
事前预测:三类禁忌要牢记,每一个都惹不了
1.忌参合神仙的事:比如那种受政策,规定,环境影响巨大的业务,不可预测,不能预测,也不要去预测。我们是不知道中央什么时候出文件的,也不知道什么时候土地爷爷不爽抖抖膀子,所以此类事件只能归于黑天鹅,效果很难事先预计。话说回来,如果能事先预知,有这么大本事为啥不去炒楼呢,突然好期待!(╯3╰)
2.忌参合皇帝的事:上有神仙下有皇帝,那种受自己公司或者合作方公司的政策,制度,规则影响很大的业务,也不要去预测。因为当一个业务受政策,制度,规则等高层主观能动性影响太大的时候,高层的决策就是唯一关键要素,事件发展只要看老板们决策就好了,完全无法按正常进展去预测。
3.忌参合妖怪的事:上有政策下有对策,在对下游管控力度弱的时候,下游的业务状况就很难按正常的逻辑去预测。最典型性的,就是下游经销商,KA势力强大,公司只能看别人脸色行事。这时候如果下游借公司促销机会钻空子套利,即无法管理,也无法预测事态走向。因为人心之险恶过于妖怪,人性之贪婪是很难预测的。
宜:收集原因数据
预测的本质原理是:过去发生的事情未来会重现,过去发生的原因和未来一样。因此当游戏规则完全不可知或被关键人物掌控的时候,预测就变得毫无意义。相应的,如果规则是市场自发形成的,可观测可追踪的,那么就可以进行预测,其中的关键就是尽可能多的收集原因数据。
举个简单的例子,公司销售额连续8个月上升,那么第9个月会不会上升呢?答案是:不知道。因为连续8个月上升是一个结果,结果不能证明结果,只有找到上游的原因才行。连续增长是因为新产品?渠道发力?促销带动?推广范围?找到原因自然可以根据原因的变化情况,预测未来的结果。这也是预测类分析的铁律:抓住原因找结果。
相应的,因为很多原因是不能收集,或者收集不全的,所以所有的预测都是有概率,有范围的,最好是给出乐观,悲观等几个可能。不在预测的时候立flag,是数据分析师与街头算命张大师的本质区别。
事中监控:理清逻辑再动手,不然下班没法走
忌只给孤立的一个或几个数字:业务方今天要个数字A,后天要个数字B,大后天要个数字C,每一个都得计算百分比/平均值,每一个都得看回过往6个月,每一个数字都是加急,每一个都要插队做,于是天天都在加班跑各种数。这就是典型的没有理清数据与项目间的逻辑,只是孤立的给数据的坏处。
宜:理清数据与项目间逻辑关系
举个栗子:我们有一个促销要针对持有VIP2级会员卡的顾客,在实体店消费指定产品组合2件以上的人奖励一个礼品,通过这个活动拉动整体消费,促进会员卡普及率。那么要看哪些数据呢?
1.从整体效果出发:既然目标是整体消费,就要把总消费当做最大KPI并且拆分到天,每天去追踪效果,既要统计当天达标率,又得计算累计数额,还要和去年对比,全方位让业务掌控整体进度。
2.从过程管理出发:各区域达标率如何?现有会员发动了多少?新会员吸引了多少?有多少只买了1件的漏网之鱼?有多少买了两件却不办会员卡的?这些指标及时给出来,可以帮助业务指导各片区,门店的执行工作。是否有区域出现所有的达标消费都出现在一个门店的怪事?这种明显反常指标提前指出来,可以帮助业务打击渠道作弊行为。
3.从运作出发:产品与礼品的库存都要够。因此每天要看各区域产品组合与礼品库存数,每天消耗数,还要根据每天参与人数,剩余参与人数,参与率三个指标计算预计所需的库存数。
因此报表至少要包含以上三类数十个字段,才可以承接到业务方的需求。这些具体的需求点要事先谈好才行,业务方没有提的要主动提示。要做到这样的清晰,首先业务方得有清晰的目标和考核指标,有清晰的推进方法,这样才能选出用那些字段来描述问题,要做那些推算,生产什么新变量。
如果还没有清晰到上边的程度,欢迎业务部门随时来和分析师交流。我们能帮你理清思路,梳理用哪些字段描述问题;我们也能提供一些过往的项目经验给到你们参考;我们还能指引你看那些平时不咋看的报表,帮你建立概念。总之多聊天,少下不清晰的需求单,对大家都有好处,(*^__^*)
事后评估:四大禁忌要牢记,不帮业务擦屁屁
1.忌找架打:“他的项目就是烂!帮我分析下烂在哪里吧!”“不好意思,没这服务”
2.忌找资源:“我的项目很缺钱!请分析下重要性吧!”“不好意思,没这服务”
3.忌找点赞:“我的项目很优秀!请着重强调下吧!”“不好意思,没这服务”
4.忌找理由:“我的活动没业绩!麻烦分析下闪光点吧!”“不好意思,没这服务”
科学性与严肃性是分析师工作的基本要求。我们只对提供的数据准确性负责任,不对各种项目,工作的结果负责任。我们可以提供必要的数据,但评价是好还是坏,和标杆有关,标杆怎么定,是业务部门需要思考和设计的。分析师可以提建议,但不要直接下结论。我们是为老板决策提供支持的,不是为某个业务条线提供善后服务的,失去了科学性和中立性,我们也会失去老板的信任。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01