京公网安备 11010802034615号
经营许可证编号:京B2-20210330
数据科学家:为什么我要离职?
作者 Jonny Brooks-Bartlett
编译 Mika
本文为 CDA 数据分析师原创作品,转载需授权
我是一名数据科学家。很多人都认为数据科学家是21世纪最性感的工作,作为数据科学家有丰厚的薪资,这无疑是一份理想工作。该领域聚集了大量高精尖人才,他们热衷于解决复杂的问题,而且热爱他们的工作。
然而事实上根据英国《金融时报》的报道,数据科学家通常“每周会花1到2个小时寻找新工作”。此外,文章还指出:“在声称寻找新工作的开发者中,机器学习专家位居第一占比达到14.3%。数据科学家紧随其后,为13.2%。“这些数据来自由Stack Overflow对6万4千名开发者的调研。
对此我深有体会,最近我刚换了新的数据科学工作。
为什么有那么多的数据科学家在找新工作呢?
在回答这个问题之前,我想声明的是我仍然是一名数据科学家。总体而言,我热爱这份工作,我也不想阻止那些想成为数据科学家的人,因为这份工作有趣,刺激而有价值。本文的目的是向你们介绍这份工作背后不那么光鲜的一面。
从我看来,数据科学家主要出于四个原因对他们的工作感到不满。
# 1. 期望与现实不符
我认识的许多初级数据科学家(包括我自己)入行都是由于,在我们看来数据科学家使用信心的机器学习算法去解决复杂问题,从而对业务产生巨大影响。我们会觉得这份工作比之前做的任何工作都重要。但是,情况往往不是如此。
在我看来,期望与现实不符是许多数据科学家离职的终极原因。当中具体有很多原因,在此我不能一一列举,这里只举出我所遇到的情况。
每家公司情况不同,不能一概而言,但是据我所知许多公司在聘请数据科学家时,并没有配备适当的基础设施,让其能够从AI中得出有价值的结论。再加上这些公司在招聘初级数据从业人员之前,并没有聘请经验丰富的资深数据专家,这样就会导致双方关系不融洽,无法达到互相期望值。
数据科学家希望在工作中,通过编写智能机器学习算法得出分析见解。但他们很难做到这点,因为他们的首要工作是整理数据基础架构,得出分析报告。相比之下,公司只希望他们能够每天在董事会中提交相应的图表。之后公司因为没有及时得到数据的价值而感到失望,所有这些又会导致数据科学家对工作的不满。
Robert Chang在他的文章中对初级数据科学家提供了很宝贵的建议:
“评估自身的期望与所处环境的关键路径是否一致非常重要。因此需要找到关键路径与你相符的项目、团队和公司。”
这突显了雇主和数据科学家之间的双向关系。如果公司的决策发展与数据科学家的目标不一致,那么数据科学家离职只是时间问题。
数据科学家感到失望的另一个原因与我对学术界失望的原因类似。我认为我能对全球各地的人们产生巨大的影响,而不仅仅是在公司内部。事实上,如果公司的核心业务不是机器学习(我的上家公司是媒体出版公司),那么你所进行的数据科学工作可能只会带来少量的价值。也许这些工作能累积带来很有价值的内容,或者你幸运地发现一个大项目,但这不并太常见。
# 2. 决策至上原则
之前我曾经早上6点起来研究支持向量机。当时我想:“这真的很难,但至少会给我未来的雇主带来价值。“ 但如果我有时光机的话,我会回到过去打消这个念头。
如果你认为掌握大量机器学习算法能让你成为最有价值的数据科学家,那么回到我说的第一点:期望与现实不符。
事实是,公司中的领导阶层需要对你有好印象最。这意味着你必须不断做领导层安排的工作,比如从数据库中获取数字,在适当的时间交给相关人员,做简单的项目,以便得到上级的好评。在我的上一份工作中,我做了大量这类工作。尽管这会让人沮丧,但却是工作的必要组成部分。
# 3. 数据方面的全能专家
公司中的领导层往往不太明白“数据科学家”的含义。这意味着在大家眼中,除了分析专家、报告专家,你还是数据库专家。
不仅仅是非技术的同事这么认为。技术方面的其他同事会认为你掌握任何与数据相关的知识。你掌握Spark、Hadoop、Hive、Pig、SQL、Neo4J、MySQL、Python、R、Scala、Tensorflow、A / B测试、NLP、以及任何机器学习和数据相关的知识。
如果在职位描述中你看到了这些具体的内容,请保持谨慎态度。这反映了该公司的工作规范,他们不清楚自身的数据策略,因为他们认为雇用的数据从业人员能够解决所有的数据问题。
但是试图告诉他人你真正掌握的内容是很难的。不是因为其他人会轻视你,而是因为作为缺少经验的初级数据科学家,你担心他人会轻视你。这是一个很棘手的情况。
# 4. 孤立的团队
当我们看到成功的数据产品时,我们经常会看到具有智能功能的用户界面设计。最重要的是,当中有输出,至少能够被用户感知并解决相关问题。
如果数据科学家花时间学习如何编写和执行机器学习算法,那么他们只构成团队中的一小部分,从而实现项目的成功。这意味着独立工作的数据科学团队将难以提供价值!
尽管如此,许多公司由数据科学团队提出自己的项目并通过编程来尝试解决问题。在某些情况下,这能够满足要求。例如,如果需要的只是每季度生成静态电子表格。
另一方面,如果目标是在定制的网站开发产品中优化提供智能建议,那么当中将涉及许多不同的技能,绝大多数是数据科学家所不具备的。因此,如果项目是由孤立的数据科学团队承担,那么很可能会失败(或者需要很长时间,因为组织孤立的团队进行大型企业的协作项目并不容易)。
# 结语
因此,要在行业中成为合格的数据科学家,仅仅在参加Kaggle比赛并学习在线课程是远远不够的。
在找数据科学工作时,找到与自身的关键路径保持一致的公司是很重要的。但是,你也需要调整自身对数据科学家职位的期望。
希望我打击你成为数据科学家的信心。
原文链接
https://towardsdatascience.com/why-so-many-data-scientists-are-leaving-their-jobs-a1f0329d7ea4
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01在数据驱动决策的时代,企业与从业者每天都会面对海量数据——电商平台的用户行为数据、金融机构的信贷风险数据、快消品牌的营销 ...
2026-04-01在数字化转型的浪潮中,企业数据已从“辅助运营的附属资源”升级为“驱动增长的核心资产”,而一套科学、可落地的企业数据管理方 ...
2026-04-01在数字化时代,每一位用户与产品的交互都会留下可追溯的行为轨迹——电商用户的浏览、加购、下单,APP用户的注册、登录、功能使 ...
2026-03-31在日常数据统计、市场调研、学术分析等场景中,我们常常需要判断两个分类变量之间是否存在关联(如性别与消费偏好、产品类型与满 ...
2026-03-31在CDA(Certified Data Analyst)数据分析师的职场实战与认证考核中,“可解释性建模”是核心需求之一——企业决策中,不仅需要 ...
2026-03-31多层感知机(MLP,Multilayer Perceptron)作为深度学习中最基础、最经典的神经网络模型,其结构设计直接决定了模型的拟合能力、 ...
2026-03-30在TensorFlow深度学习实战中,数据集的加载与预处理是基础且关键的第一步。手动下载、解压、解析数据集不仅耗时费力,还容易出现 ...
2026-03-30在CDA(Certified Data Analyst)数据分析师的日常工作中,“无监督分组、挖掘数据内在聚类规律”是高频核心需求——电商场景中 ...
2026-03-30机器学习的本质,是让模型通过对数据的学习,自主挖掘规律、实现预测与决策,而这一过程的核心驱动力,并非单一参数的独立作用, ...
2026-03-27在SQL Server数据库操作中,日期时间处理是高频核心需求——无论是报表统计中的日期格式化、数据筛选时的日期类型匹配,还是业务 ...
2026-03-27