京公网安备 11010802034615号
经营许可证编号:京B2-20210330
数据科学家:为什么我要离职…
我是一名数据科学家。
很多人都认为数据科学家是21世纪最性感的工作,作为数据科学家有丰厚的薪资,这无疑是一份理想工作。该领域聚集了大量高精尖人才,他们热衷于解决复杂的问题,而且热爱他们的工作。
然而事实上根据英国《金融时报》的报道,数据科学家通常“每周会花1到2个小时寻找新工作”。此外,文章还指出:“在声称寻找新工作的开发者中,机器学习专家位居第一占比达到14.3%。数据科学家紧随其后,为13.2%。“这些数据来自由Stack Overflow对6万4千名开发者的调研。
对此我深有体会,最近我刚换了新的数据科学工作。
为什么有那么多的数据科学家在找新工作呢?
在回答这个问题之前,我想声明的是我仍然是一名数据科学家。我热爱这份工作,我也不想阻止那些想成为数据科学家的人,因为这份工作有趣,刺激而有价值。本文的目的是向你们介绍这份工作背后不那么光鲜的一面。
从我看来,数据科学家主要出于四个原因对他们的工作感到不满。
1. 期望与现实不符
我认识的许多初级数据科学家(包括我自己)入行都是由于,在我们看来数据科学家使用新型的机器学习算法去解决复杂问题,从而对业务产生巨大影响。我们会觉得这份工作比之前做的任何工作都重要。但是,情况往往不是如此。
在我看来,期望与现实不符是许多数据科学家离职的终极原因。当中具体有很多原因,在此我不能一一列举,这里只举出我所遇到的情况。
每家公司情况不同,不能一概而言。但是据我所知,许多公司在聘请数据科学家时,并没有配备适当的基础设施,让其能够从AI中得出有价值的结论。再加上这些公司在招聘初级数据从业人员之前,并没有聘请经验丰富的资深数据专家,这样就会导致双方关系不融洽,无法达到互相期望值。
数据科学家希望在工作中,通过编写智能机器学习算法得出分析见解。但他们很难做到这点,因为他们的首要工作是整理数据基础架构,得出分析报告。相比之下,公司只希望他们能够每天在董事会中提交相应的图表。之后公司因为没有及时得到数据的价值而感到失望,所有这些又会导致数据科学家对工作的不满。
Robert Chang在他的文章中对初级数据科学家提供了很宝贵的建议:
“评估自身的期望与所处环境的关键路径是否一致非常重要。因此需要找到关键路径与你相符的项目、团队和公司。”
这突显了雇主和数据科学家之间的双向关系。如果公司的决策发展与数据科学家的目标不一致,那么数据科学家离职只是时间问题。
数据科学家感到失望的另一个原因与我对学术界失望的原因类似。我认为我能对全球各地的人们产生巨大的影响,而不仅仅是在公司内部。事实上,如果公司的核心业务不是机器学习(我的上家公司是媒体出版公司),那么你所进行的数据科学工作可能只会带来少量的价值。也许这些工作能累积带来很有价值的内容,或者你幸运地发现一个大项目,但这不并太常见。
2. 决策至上原则
我曾经早上6点起来研究支持向量机。当时我想:“这真的很难,但至少会给我未来的雇主带来价值。“ 但如果我有时光机的话,我会回到过去打消这个念头。
如果你认为掌握大量机器学习算法能让你成为最有价值的数据科学家,那么回到我说的第一点:期望与现实不符。
事实是,公司中的领导阶层需要对你有好印象。这意味着你必须不断做领导层安排的工作,比如从数据库中获取数字,在适当的时间交给相关人员,做简单的项目,以便得到上级的好评。在我的上一份工作中,我做了大量这类工作。尽管这会让人沮丧,但却是工作的必要组成部分。
3. 数据方面的全能专家
公司中的领导层往往不太明白“数据科学家”的含义。这意味着在大家眼中,除了分析专家、报告专家,你还是数据库专家。
不仅仅是非技术的同事这么认为。技术方面的其他同事会认为你掌握任何与数据相关的知识。你掌握Spark、Hadoop、Hive、Pig、SQL、Neo4J、MySQL、Python、R、Scala、Tensorflow、A / B测试、NLP、以及任何机器学习和数据相关的知识。
如果在职位描述中你看到了这些具体的内容,请保持谨慎态度。这反映了该公司的工作规范,他们不清楚自身的数据策略,因为他们认为雇用的数据从业人员能够解决所有的数据问题。
但是试图告诉他人你真正掌握的技能是很难的。不是因为其他人会轻视你,而是因为作为缺少经验的初级数据科学家,你担心他人会轻视你。这是一个很棘手的情况。
4. 在孤立的团队中工作
当我们看到成功的数据产品时,我们经常会看到具有智能功能的用户界面设计。重要的是当中有输出,能够被用户感知并解决相关问题。
数据科学家花时间学习编写和执行机器学习算法,然而他们只构成团队中的一小部分。这意味着独立工作的数据科学团队将难以提供价值!
尽管如此,许多公司由数据科学团队提出自己的项目,并通过编程来尝试解决问题。在某些情况下,这能够满足要求。例如,如果需要的只是每季度生成静态电子表格。
另一方面,如果目标是在定制的网站开发产品中优化提供智能建议,那么当中将涉及许多不同的技能,绝大多数是数据科学家所不具备的。因此,如果项目是由孤立的数据科学团队承担,那么很可能会失败(或者需要很长时间,因为组织孤立的团队进行大型企业的协作项目并不容易)。
结语
因此,要在行业中成为合格的数据科学家,仅仅在参加Kaggle比赛并学习在线课程是远远不够的。
在找数据科学工作时,找到与自身的关键路径保持一致的公司是很重要的。但是,你也需要调整自身对数据科学家职位的期望。
希望我没有打击你成为数据科学家的信心。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析的核心价值在于用数据驱动决策,而指标作为数据的“载体”,其选取的合理性直接决定分析结果的有效性。选对指标能精准定 ...
2026-01-23在MySQL查询编写中,我们习惯按“SELECT → FROM → WHERE → ORDER BY”的语法顺序组织语句,直觉上认为代码顺序即执行顺序。但 ...
2026-01-23数字化转型已从企业“可选项”升级为“必答题”,其核心本质是通过数据驱动业务重构、流程优化与模式创新,实现从传统运营向智能 ...
2026-01-23CDA持证人已遍布在世界范围各行各业,包括世界500强企业、顶尖科技独角兽、大型金融机构、国企事业单位、国家行政机关等等,“CDA数据分析师”人才队伍遵守着CDA职业道德准则,发挥着专业技能,已成为支撑科技发展的核心力量。 ...
2026-01-22在数字化时代,企业积累的海量数据如同散落的珍珠,而数据模型就是串联这些珍珠的线——它并非简单的数据集合,而是对现实业务场 ...
2026-01-22在数字化运营场景中,用户每一次点击、浏览、交互都构成了行为轨迹,这些轨迹交织成海量的用户行为路径。但并非所有路径都具备业 ...
2026-01-22在数字化时代,企业数据资产的价值持续攀升,数据安全已从“合规底线”升级为“生存红线”。企业数据安全管理方法论以“战略引领 ...
2026-01-22在SQL数据分析与业务查询中,日期数据是高频处理对象——订单创建时间、用户注册日期、数据统计周期等场景,都需对日期进行格式 ...
2026-01-21在实际业务数据分析中,单一数据表往往无法满足需求——用户信息存储在用户表、消费记录在订单表、商品详情在商品表,想要挖掘“ ...
2026-01-21在数字化转型浪潮中,企业数据已从“辅助资源”升级为“核心资产”,而高效的数据管理则是释放数据价值的前提。企业数据管理方法 ...
2026-01-21在数字化商业环境中,数据已成为企业优化运营、抢占市场、规避风险的核心资产。但商业数据分析绝非“堆砌数据、生成报表”的简单 ...
2026-01-20定量报告的核心价值是传递数据洞察,但密密麻麻的表格、复杂的计算公式、晦涩的数值罗列,往往让读者望而却步,导致核心信息被淹 ...
2026-01-20在CDA(Certified Data Analyst)数据分析师的工作场景中,“精准分类与回归预测”是高频核心需求——比如预测用户是否流失、判 ...
2026-01-20在建筑工程造价工作中,清单汇总分类是核心环节之一,尤其是针对楼梯、楼梯间这类包含多个分项工程(如混凝土浇筑、钢筋制作、扶 ...
2026-01-19数据清洗是数据分析的“前置必修课”,其核心目标是剔除无效信息、修正错误数据,让原始数据具备准确性、一致性与可用性。在实际 ...
2026-01-19在CDA(Certified Data Analyst)数据分析师的日常工作中,常面临“无标签高维数据难以归类、群体规律模糊”的痛点——比如海量 ...
2026-01-19在数据仓库与数据分析体系中,维度表与事实表是构建结构化数据模型的核心组件,二者如同“骨架”与“血肉”,协同支撑起各类业务 ...
2026-01-16在游戏行业“存量竞争”的当下,玩家留存率直接决定游戏的生命周期与商业价值。一款游戏即便拥有出色的画面与玩法,若无法精准识 ...
2026-01-16为配合CDA考试中心的 2025 版 CDA Level III 认证新大纲落地,CDA 网校正式推出新大纲更新后的第一套官方模拟题。该模拟题严格遵 ...
2026-01-16在数据驱动决策的时代,数据分析已成为企业运营、产品优化、业务增长的核心工具。但实际工作中,很多数据分析项目看似流程完整, ...
2026-01-15