京公网安备 11010802034615号
经营许可证编号:京B2-20210330
数据科学家:为什么我要离职?
作者 Jonny Brooks-Bartlett
编译 Mika
本文为 CDA 数据分析师原创作品,转载需授权
我是一名数据科学家。很多人都认为数据科学家是21世纪最性感的工作,作为数据科学家有丰厚的薪资,这无疑是一份理想工作。该领域聚集了大量高精尖人才,他们热衷于解决复杂的问题,而且热爱他们的工作。
然而事实上根据英国《金融时报》的报道,数据科学家通常“每周会花1到2个小时寻找新工作”。此外,文章还指出:“在声称寻找新工作的开发者中,机器学习专家位居第一占比达到14.3%。数据科学家紧随其后,为13.2%。“这些数据来自由Stack Overflow对6万4千名开发者的调研。
对此我深有体会,最近我刚换了新的数据科学工作。
为什么有那么多的数据科学家在找新工作呢?
在回答这个问题之前,我想声明的是我仍然是一名数据科学家。总体而言,我热爱这份工作,我也不想阻止那些想成为数据科学家的人,因为这份工作有趣,刺激而有价值。本文的目的是向你们介绍这份工作背后不那么光鲜的一面。
从我看来,数据科学家主要出于四个原因对他们的工作感到不满。
# 1. 期望与现实不符
我认识的许多初级数据科学家(包括我自己)入行都是由于,在我们看来数据科学家使用信心的机器学习算法去解决复杂问题,从而对业务产生巨大影响。我们会觉得这份工作比之前做的任何工作都重要。但是,情况往往不是如此。
在我看来,期望与现实不符是许多数据科学家离职的终极原因。当中具体有很多原因,在此我不能一一列举,这里只举出我所遇到的情况。
每家公司情况不同,不能一概而言,但是据我所知许多公司在聘请数据科学家时,并没有配备适当的基础设施,让其能够从AI中得出有价值的结论。再加上这些公司在招聘初级数据从业人员之前,并没有聘请经验丰富的资深数据专家,这样就会导致双方关系不融洽,无法达到互相期望值。
数据科学家希望在工作中,通过编写智能机器学习算法得出分析见解。但他们很难做到这点,因为他们的首要工作是整理数据基础架构,得出分析报告。相比之下,公司只希望他们能够每天在董事会中提交相应的图表。之后公司因为没有及时得到数据的价值而感到失望,所有这些又会导致数据科学家对工作的不满。
Robert Chang在他的文章中对初级数据科学家提供了很宝贵的建议:
“评估自身的期望与所处环境的关键路径是否一致非常重要。因此需要找到关键路径与你相符的项目、团队和公司。”
这突显了雇主和数据科学家之间的双向关系。如果公司的决策发展与数据科学家的目标不一致,那么数据科学家离职只是时间问题。
数据科学家感到失望的另一个原因与我对学术界失望的原因类似。我认为我能对全球各地的人们产生巨大的影响,而不仅仅是在公司内部。事实上,如果公司的核心业务不是机器学习(我的上家公司是媒体出版公司),那么你所进行的数据科学工作可能只会带来少量的价值。也许这些工作能累积带来很有价值的内容,或者你幸运地发现一个大项目,但这不并太常见。
# 2. 决策至上原则
之前我曾经早上6点起来研究支持向量机。当时我想:“这真的很难,但至少会给我未来的雇主带来价值。“ 但如果我有时光机的话,我会回到过去打消这个念头。
如果你认为掌握大量机器学习算法能让你成为最有价值的数据科学家,那么回到我说的第一点:期望与现实不符。
事实是,公司中的领导阶层需要对你有好印象最。这意味着你必须不断做领导层安排的工作,比如从数据库中获取数字,在适当的时间交给相关人员,做简单的项目,以便得到上级的好评。在我的上一份工作中,我做了大量这类工作。尽管这会让人沮丧,但却是工作的必要组成部分。
# 3. 数据方面的全能专家
公司中的领导层往往不太明白“数据科学家”的含义。这意味着在大家眼中,除了分析专家、报告专家,你还是数据库专家。
不仅仅是非技术的同事这么认为。技术方面的其他同事会认为你掌握任何与数据相关的知识。你掌握Spark、Hadoop、Hive、Pig、SQL、Neo4J、MySQL、Python、R、Scala、Tensorflow、A / B测试、NLP、以及任何机器学习和数据相关的知识。
如果在职位描述中你看到了这些具体的内容,请保持谨慎态度。这反映了该公司的工作规范,他们不清楚自身的数据策略,因为他们认为雇用的数据从业人员能够解决所有的数据问题。
但是试图告诉他人你真正掌握的内容是很难的。不是因为其他人会轻视你,而是因为作为缺少经验的初级数据科学家,你担心他人会轻视你。这是一个很棘手的情况。
# 4. 孤立的团队
当我们看到成功的数据产品时,我们经常会看到具有智能功能的用户界面设计。最重要的是,当中有输出,至少能够被用户感知并解决相关问题。
如果数据科学家花时间学习如何编写和执行机器学习算法,那么他们只构成团队中的一小部分,从而实现项目的成功。这意味着独立工作的数据科学团队将难以提供价值!
尽管如此,许多公司由数据科学团队提出自己的项目并通过编程来尝试解决问题。在某些情况下,这能够满足要求。例如,如果需要的只是每季度生成静态电子表格。
另一方面,如果目标是在定制的网站开发产品中优化提供智能建议,那么当中将涉及许多不同的技能,绝大多数是数据科学家所不具备的。因此,如果项目是由孤立的数据科学团队承担,那么很可能会失败(或者需要很长时间,因为组织孤立的团队进行大型企业的协作项目并不容易)。
# 结语
因此,要在行业中成为合格的数据科学家,仅仅在参加Kaggle比赛并学习在线课程是远远不够的。
在找数据科学工作时,找到与自身的关键路径保持一致的公司是很重要的。但是,你也需要调整自身对数据科学家职位的期望。
希望我打击你成为数据科学家的信心。
原文链接
https://towardsdatascience.com/why-so-many-data-scientists-are-leaving-their-jobs-a1f0329d7ea4
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在企业数据化运营体系中,同比、环比分析是洞察业务趋势、评估运营效果的核心手段。同比(与上年同期对比)可消除季节性波动影响 ...
2025-12-19在数字化时代,用户已成为企业竞争的核心资产,而“理解用户”则是激活这一资产的关键。用户行为分析系统(User Behavior Analys ...
2025-12-19在数字化转型的深水区,企业对数据价值的挖掘不再局限于零散的分析项目,而是转向“体系化运营”——数据治理体系作为保障数据全 ...
2025-12-19在数据科学的工具箱中,析因分析(Factor Analysis, FA)、聚类分析(Clustering Analysis)与主成分分析(Principal Component ...
2025-12-18自2017年《Attention Is All You Need》一文问世以来,Transformer模型凭借自注意力机制的强大建模能力,在NLP、CV、语音等领域 ...
2025-12-18在CDA(Certified Data Analyst)数据分析师的时间序列分析工作中,常面临这样的困惑:某电商平台月度销售额增长20%,但增长是来 ...
2025-12-18在机器学习实践中,“超小数据集”(通常指样本量从几十到几百,远小于模型参数规模)是绕不开的场景——医疗领域的罕见病数据、 ...
2025-12-17数据仓库作为企业决策分析的“数据中枢”,其价值完全依赖于数据质量——若输入的是缺失、重复、不一致的“脏数据”,后续的建模 ...
2025-12-17在CDA(Certified Data Analyst)数据分析师的日常工作中,“随时间变化的数据”无处不在——零售企业的每日销售额、互联网平台 ...
2025-12-17在休闲游戏的运营体系中,次日留存率是当之无愧的“生死线”——它不仅是衡量产品核心吸引力的首个关键指标,更直接决定了后续LT ...
2025-12-16在数字化转型浪潮中,“以用户为中心”已成为企业的核心经营理念,而用户画像则是企业洞察用户、精准决策的“核心工具”。然而, ...
2025-12-16在零售行业从“流量争夺”转向“价值深耕”的演进中,塔吉特百货(Target)以两场标志性实践树立了行业标杆——2000年后的孕妇精 ...
2025-12-15在统计学领域,二项分布与卡方检验是两个高频出现的概念,二者都常用于处理离散数据,因此常被初学者混淆。但本质上,二项分布是 ...
2025-12-15在CDA(Certified Data Analyst)数据分析师的工作链路中,“标签加工”是连接原始数据与业务应用的关键环节。企业积累的用户行 ...
2025-12-15在Python开发中,HTTP请求是与外部服务交互的核心场景——调用第三方API、对接微服务、爬取数据等都离不开它。虽然requests库已 ...
2025-12-12在数据驱动决策中,“数据波动大不大”是高频问题——零售店长关心日销售额是否稳定,工厂管理者关注产品尺寸偏差是否可控,基金 ...
2025-12-12在CDA(Certified Data Analyst)数据分析师的能力矩阵中,数据查询语言(SQL)是贯穿工作全流程的“核心工具”。无论是从数据库 ...
2025-12-12很多小伙伴都在问CDA考试的问题,以下是结合 2025 年最新政策与行业动态更新的 CDA 数据分析师认证考试 Q&A,覆盖考试内容、报考 ...
2025-12-11在Excel数据可视化中,柱形图因直观展示数据差异的优势被广泛使用,而背景色设置绝非简单的“换颜色”——合理的背景色能突出核 ...
2025-12-11在科研实验、商业分析或医学研究中,我们常需要判断“两组数据的差异是真实存在,还是偶然波动”——比如“新降压药的效果是否优 ...
2025-12-11