
数据分析的出路在哪里
数据分析的出路在哪里?类似问题出现在很多场景下:
有的是面试的时候被问到:你觉得这个职位长期发展的前景如何
有的是在各种群里的讨论:Data Scientist 的出路在哪里?为什么做 Analytics 的活 title 却是 Data Scientist?
有的是同事之间的交流:你接下来做啥?
问法不同,但讨论的内容其实是类似的:数据分析 (Analytics) 有什么用?
我们先看一下数据分析的几个阶段:
第一阶段:没有数据,更没有分析
不管是产品也好,还是策略也好,凭的是从上到下的决定,靠的是经验和感觉。
最后效果如何,没有一个数据上的衡量标准,或者只有简单粗暴的几个数据:有多少人用(购买),收入多少,成本多少,最后赚了多少。
第二阶段:有数据,看起来好像有分析
这个阶段,数据多起来了,比如除了有多少人用,还有更多多维度的数据,比如年龄、性别、地区等等,也有了更多层次的数据,比如各种留存、拉新等方面。
分析方面则是有各种报表,看得眼花缭乱,很全面。
问题在于,这种情形下我们知道发生了什么,可能知道得还挺详细,但是并不知道为什么会发生这些,以及接下来可能发生什么。
于是进入
第三阶段:有数据,有分析,有原因
这个阶段开始引入 hypothesis 的概念,我们不但要知道发生了什么(reporting),还要知道为什么会发生 (hypothesis driven).
知道了为什么会发生,可以告诉我们以后做类似的事情,可能会发生什么。
可能是通过 correlation analysis,找到一些互相有关系的线索。
可能是通过 A/B test,找到因果性。
诸如此类。
而在这个阶段做各种分析,A/B test 的时候,需要有 hypothesis-driven 的概念,而不能仅仅是:来,我们看下数据是什么样子的。
比如 A/B test 能提供因果性,帮我们做决定是一方面 (launch product or not),更重要的是能帮助我们积累某一领域的知识,诸如提高 metrics A 可以提升留存;进一步, 我们可以知道提高 x% 的 A 可以提升 y% 的留存;再进一步,我们甚至还能搞清楚,对于不同的用户、不同的阶段,这个 x% -> y% 是不一样的。
而这也是 analytics 的工作会挂着 Data Scientist 的 title.
Scientist 的定义并不是工作方法多么高大上,而在于其思绪方式:通过 hypothesis-driven,不但要知道发生了什么,还要知道为什么发生。
(当然另一方面也是因为 Data Scientsit 这个名字比较好听了)
第四阶段:知道发生了什么、知道为什么发生、知道接下来应该做什么
跟上一阶段的区别在于,我们不但知道发生了什么 (reporting),知道为什么发生 (hypothesis-driven),还知道接下来应该做什么 (product/strategy leadership).
这个阶段有很多难点:本身搞清楚应该做什么就很难,还需要把这些东西 sell 出去,就更是难上加难了,而这恰恰是数据分析的出路(之一)。
不管数据分析做出了什么结果,如果没有把结论应用到实际 product change 里面去的话,都是垃圾。
知道发生了什么,比如 reporting,风险低回报低,因为不太能改变产品走向。
有些类型的数据分析,知道为什么发生,比如 A/B test,算是能改变产品走向,至少能决定 launch / no launch.
上面两点对于大多数人来说又是必不可少的,除去工作本身会有需要以外,还有很重要的一点是通过这些事情来跟合作者打下互相信任的基础,比如 product/engineering/design/UX research.
如果一上来就抛出数据分析的结论说咱们组接下来应该做 ABCD,要么他/她已经有了 track record,大家都很信任;要么其实产品组也不知道做什么,反正试试看呗。
所以大多数情况下,还是需要通过一些基本的项目打点基础,让 cross function team 觉得:哎不错,这个人挺靠谱的,数据分析做出来的东西还是要信的。
接下来再慢慢提供产品的方向:我们接下来一个月应该试试做 A,可能会有预期的效果。
于是试了一下做 A,发现预期的效果没错,信任进一步建立。
于是再接下来:我们接下来半年应该试试做 B, C, D,其中 B 可能性比较大,但是回报也不会太大;C 风险比较大,但是如果成功的话回报也多;D 则是一个新的方向,做成做不成不知道,咱们试试看。成的话一起喝汤吃肉,不成的话再试试别的。
因为有了前面打下的互相信任的基础,即使最后 C 和 D 都没有做成,也不会被觉得是数据分析本身不够 solid,瞎提供方向,而是这些项目本来就是有风险的。
当然了,如果没有互相信任的基础的话,很有可能大家也不会做 C 和 D,只会做 B.
而 B 的方向,很有可能本来就是打算做的,最后结果是数据分析提供了 support,而不是 lead.
对于大多数数据分析来说,阶段二是基础,阶段三是应该做到的,阶段四是好像能做到一些,但是还有很大提高余地的。
而数据分析的出路和影响力,就来源于四。
这也是为什么很多数据分析的职位看起来要求很低:第四阶段做得如何,实在是太难量化了。
从某个角度来说,数据分析跟算命是类似的:先告诉你人生过去的几十年发生了什么,你一对比发现说得还真不错 (reporting);然后说你当下是不是有什么忧虑,在担心什么 (hypothesis driven);再说你要解决这些问题,需要做 ABCD ( product leadership).
算命先生想要产生 impact,就需要把 reporting 做得准,hypothesis 搞得清楚,这样客户才能相信,接下来才能忽悠。
当然,数据分析做的事情,跟算命的区别在于最后一点:如果算命先生说的不对,你也不能回头去找他把摊儿掀了;而数据分析总是说得不对的话,摊儿可能真就没了。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
破解游戏用户流失困局:从数据洞察到留存策略 在游戏行业竞争白热化的当下,用户流失率已成为衡量产品健康度的核心指标。一款游 ...
2025-08-11PyTorch 中 Shuffle 机制:数据打乱的艺术与实践 在深度学习模型训练过程中,数据的呈现顺序往往对模型性能有着微妙却关键的影响 ...
2025-08-11数据时代的黄金入场券:CDA 认证解锁职业新蓝海 一、万亿级市场需求下的数据分析人才缺口 在数字化转型浪潮中,数据已成为企业核 ...
2025-08-11DBeaver 实战:实现两个库表结构同步的高效路径 在数据库管理与开发工作中,保持不同环境(如开发库与生产库、主库与从库)的表 ...
2025-08-08t 检验与卡方检验:数据分析中的两大统计利器 在数据分析领域,统计检验是验证假设、挖掘数据规律的重要手段。其中,t 检验和卡 ...
2025-08-08CDA 数据分析师:解锁数据价值的专业力量 在当今这个数据爆炸的时代,数据已成为像石油一样珍贵的战略资源。而 CDA 数据分析师, ...
2025-08-08人工智能对CDA数据分析领域的影响 人工智能对 CDA(Certified Data Analyst,注册数据分析师)数据分析领域的影响是全方位、多层 ...
2025-08-07SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-08-07SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-08-07CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-07大数据时代对定性分析的影响 在大数据时代,海量、多样、高速且低价值密度的数据充斥着我们的生活与工作。而定性分析作为一 ...
2025-08-07K-S 曲线、回归与分类:数据分析中的重要工具 在数据分析与机器学习领域,K-S 曲线、回归和分类是三个核心概念与工具,它们各 ...
2025-08-07CDA 数据分析师考试全解析 在当今数字化时代,数据已成为企业发展的核心驱动力,数据分析师这一职业也愈发受到重视。CDA 数据分 ...
2025-08-07大数据时代的隐患:繁荣背后的隐忧 当我们在电商平台浏览商品时,系统总能 “精准” 推送心仪的物品;当我们刷短视频时,算法 ...
2025-08-07解析 F 边界检验:协整分析中的实用工具 在计量经济学的时间序列分析中,判断变量之间是否存在长期稳定的均衡关系(即协整关系) ...
2025-08-07CDA 数据分析师报考条件详解:迈向专业认证的指南 在数据分析行业蓬勃发展的当下,CDA 数据分析师认证成为众多从业者提升专业 ...
2025-08-07通过 COX 回归模型诊断异常值 一、COX 回归模型概述 COX 回归模型,又称比例风险回归模型,是一种用于生存分析的统计方法。它能 ...
2025-08-07评判两组数据与初始数据准确值的方法 在数据分析与研究中,我们常常会面临这样的情况:需要对通过不同方法、不同过程得到的两组 ...
2025-08-07CDA 数据分析师行业标准:构建数据人才的能力坐标系 在数据驱动决策成为企业核心竞争力的时代,CDA(数据分析师)行业标准作为 ...
2025-08-07反向传播神经网络:突破传统算法瓶颈的革命性力量 在人工智能发展的历史长河中,传统算法曾长期主导着数据处理与模式识别领域 ...
2025-08-07