京公网安备 11010802034615号
经营许可证编号:京B2-20210330
数据分析的出路在哪里
数据分析的出路在哪里?类似问题出现在很多场景下:
有的是面试的时候被问到:你觉得这个职位长期发展的前景如何
有的是在各种群里的讨论:Data Scientist 的出路在哪里?为什么做 Analytics 的活 title 却是 Data Scientist?
有的是同事之间的交流:你接下来做啥?
问法不同,但讨论的内容其实是类似的:数据分析 (Analytics) 有什么用?
我们先看一下数据分析的几个阶段:
第一阶段:没有数据,更没有分析
不管是产品也好,还是策略也好,凭的是从上到下的决定,靠的是经验和感觉。
最后效果如何,没有一个数据上的衡量标准,或者只有简单粗暴的几个数据:有多少人用(购买),收入多少,成本多少,最后赚了多少。
第二阶段:有数据,看起来好像有分析
这个阶段,数据多起来了,比如除了有多少人用,还有更多多维度的数据,比如年龄、性别、地区等等,也有了更多层次的数据,比如各种留存、拉新等方面。
分析方面则是有各种报表,看得眼花缭乱,很全面。
问题在于,这种情形下我们知道发生了什么,可能知道得还挺详细,但是并不知道为什么会发生这些,以及接下来可能发生什么。
于是进入
第三阶段:有数据,有分析,有原因
这个阶段开始引入 hypothesis 的概念,我们不但要知道发生了什么(reporting),还要知道为什么会发生 (hypothesis driven).
知道了为什么会发生,可以告诉我们以后做类似的事情,可能会发生什么。
可能是通过 correlation analysis,找到一些互相有关系的线索。
可能是通过 A/B test,找到因果性。
诸如此类。
而在这个阶段做各种分析,A/B test 的时候,需要有 hypothesis-driven 的概念,而不能仅仅是:来,我们看下数据是什么样子的。
比如 A/B test 能提供因果性,帮我们做决定是一方面 (launch product or not),更重要的是能帮助我们积累某一领域的知识,诸如提高 metrics A 可以提升留存;进一步, 我们可以知道提高 x% 的 A 可以提升 y% 的留存;再进一步,我们甚至还能搞清楚,对于不同的用户、不同的阶段,这个 x% -> y% 是不一样的。
而这也是 analytics 的工作会挂着 Data Scientist 的 title.
Scientist 的定义并不是工作方法多么高大上,而在于其思绪方式:通过 hypothesis-driven,不但要知道发生了什么,还要知道为什么发生。
(当然另一方面也是因为 Data Scientsit 这个名字比较好听了)
第四阶段:知道发生了什么、知道为什么发生、知道接下来应该做什么
跟上一阶段的区别在于,我们不但知道发生了什么 (reporting),知道为什么发生 (hypothesis-driven),还知道接下来应该做什么 (product/strategy leadership).
这个阶段有很多难点:本身搞清楚应该做什么就很难,还需要把这些东西 sell 出去,就更是难上加难了,而这恰恰是数据分析的出路(之一)。
不管数据分析做出了什么结果,如果没有把结论应用到实际 product change 里面去的话,都是垃圾。
知道发生了什么,比如 reporting,风险低回报低,因为不太能改变产品走向。
有些类型的数据分析,知道为什么发生,比如 A/B test,算是能改变产品走向,至少能决定 launch / no launch.
上面两点对于大多数人来说又是必不可少的,除去工作本身会有需要以外,还有很重要的一点是通过这些事情来跟合作者打下互相信任的基础,比如 product/engineering/design/UX research.
如果一上来就抛出数据分析的结论说咱们组接下来应该做 ABCD,要么他/她已经有了 track record,大家都很信任;要么其实产品组也不知道做什么,反正试试看呗。
所以大多数情况下,还是需要通过一些基本的项目打点基础,让 cross function team 觉得:哎不错,这个人挺靠谱的,数据分析做出来的东西还是要信的。
接下来再慢慢提供产品的方向:我们接下来一个月应该试试做 A,可能会有预期的效果。
于是试了一下做 A,发现预期的效果没错,信任进一步建立。
于是再接下来:我们接下来半年应该试试做 B, C, D,其中 B 可能性比较大,但是回报也不会太大;C 风险比较大,但是如果成功的话回报也多;D 则是一个新的方向,做成做不成不知道,咱们试试看。成的话一起喝汤吃肉,不成的话再试试别的。
因为有了前面打下的互相信任的基础,即使最后 C 和 D 都没有做成,也不会被觉得是数据分析本身不够 solid,瞎提供方向,而是这些项目本来就是有风险的。
当然了,如果没有互相信任的基础的话,很有可能大家也不会做 C 和 D,只会做 B.
而 B 的方向,很有可能本来就是打算做的,最后结果是数据分析提供了 support,而不是 lead.
对于大多数数据分析来说,阶段二是基础,阶段三是应该做到的,阶段四是好像能做到一些,但是还有很大提高余地的。
而数据分析的出路和影响力,就来源于四。
这也是为什么很多数据分析的职位看起来要求很低:第四阶段做得如何,实在是太难量化了。
从某个角度来说,数据分析跟算命是类似的:先告诉你人生过去的几十年发生了什么,你一对比发现说得还真不错 (reporting);然后说你当下是不是有什么忧虑,在担心什么 (hypothesis driven);再说你要解决这些问题,需要做 ABCD ( product leadership).
算命先生想要产生 impact,就需要把 reporting 做得准,hypothesis 搞得清楚,这样客户才能相信,接下来才能忽悠。
当然,数据分析做的事情,跟算命的区别在于最后一点:如果算命先生说的不对,你也不能回头去找他把摊儿掀了;而数据分析总是说得不对的话,摊儿可能真就没了。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-10在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-10在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01