
好的决策应该是“数据驱动”的,但是如果数据有效性不好,就不可能据此做出好的决定。我的整个职业生涯几乎都在做市场调研和调查数据分析方面的工作,根据我的经验,我已经找到了一个试金石,能够判断一组业务数据是否值得在决策过程中引用。
要想从有效有用的数据中剔除虚假无效的数据,就需要问以下九个问题。如果对于任何一个问题的答案是“是的”,那么这些数据就是虚假的。
1. 这些数据的来源是否以此牟利?
如果收集数据的机构能够通过扭曲数据获得经济利益,那么数据就会被扭曲。例如,我曾经听到过一名市场研究员(一名外部顾问)询问雇佣了他的市场营销人员:“你想要数据说什么?”那么他所提交的研究报告中的数据一定经过了仔细地调整,以便反映这个观点。
2. 原始数据是否没有公布?
任何缺少原始数据的研究结果都是虚假的。原始数据不公布一定是因为以下的某一个原因:
原始数据实际上完全证明了别的事情。
原始数据会显示出该研究使用了奇怪的定义或者有偏见的问题。(参见下面的第三点和第五点。)
原始数据不存在,因为研究结果完全是某人的“信口雌黄”,就像他们交易中所说的那样。
3. 是否扭曲了正常的定义?
虽然人类的语言本质上市不精确的,但是如果一份调查问卷或者调查提纲中对于某个词的定义超出了其普遍接受的含义,那么和这个词相关的所有数据就都是虚假的。例如,一项调查将“客户满意”定义为“未退回所购产品”就显然会误导读者,错误地理解你对客户服务的好坏程度。
4. 被调查者是否不是随机选取的?
如果一项调查只询问那些保证会提供特定回答的人,那么收集到的数据就会反应出这样的意见。例如,我有一次看到一家广告公司对于那些购买了该广告的出版商的销售经理们进行调查,用这种方法来衡量“广告效果”。不用说啦,这款广告的效果一定是“效果好极了”。
5. 是否在调查中使用了诱导性问题?
你如何问一个问题往往会让接受调查的人按照可预见的方式来回答。我们可以看看一个来自政府的例子,如果一名研究人员询问退休人员“你是否赞成政府援助?”那么你就会得到和“你是否支持联邦医疗保险?”相反的答案。
6. 结果是否计算了平均值?
如果用“平均”的概念来分析的话,即使是好数据也会变成糟糕的数据。例如,在一个房间里有一名亿万富翁和九百九十九个身无分文的乞丐,他们的平均财富是一百万美元。有效的数据应该使用“中位数”,当所有其他的值都是按照顺序排列的时候,中位数是中值。在上面那个例子中,财富的中位数是零。
7. 接受调查的人是否是自我选择的?
企业通常会进行网络调查,由访问网站的人决定是否愿意参与调查。但是,任何基于“自我选择”的调查结果都必然是虚假数据。例如,如果我在网站上贴出一个类似这样的问题,“我们的客户服务如何?”只有那些得到非常好或者非常糟糕的客户服务体验的人才会参与回答。结果你就会对于客户通常会得到什么样的服务体验毫无概念。
8. 是否先入为主地假定了因果关系?
即使两组数据看起来步调一致,你也不知道这种一致性是否有意义,除非你很确定地知道一组数据会导致另一组数据。例如,如果销售收入在你的销售人员参加了销售培训课程之后出现了上升,那么这种收入的上升可能是因为销售培训起了作用,也有可能是因为和销售培训无关的因素,例如经济回暖的因素。相关性并不一定是因果关系。
9. 是否缺乏独立的确认?
科学研究在其他人(原始研究人员之外)独立地证明了研究成果之前,是不会被视为有效的。不幸的是,绝大多数市场研究都是单一来源的,这就让它变得天然不可靠。例如,如同上面那个例子中所说的,你的销售收入在销售人员参加了销售培训之后出现了增长,那么这种增长可能是因为销售培训发挥了作用,也有可能是其他的、和销售培训无关的因素造成的,例如经济回暖。相关性并不一定是因果关系。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28