当我第一次从金融学过渡到数据科学时,我觉得自己就像站在了世界之巅--我在我梦想的领域找到了一份工作,我的职业轨迹已经确定,我只会低着头努力工作,哪里会出错?嗯,有几件事……在接下来的一年里,作为一名数据科学家,我很高兴我发现自己在职业生涯早期犯了几个错误。这样,我就有时间在为时已晚之前进行反思和纠正。过了一会儿,我意识到这些错误是相当普遍的。事实上,我已经观察到我周围的很多DS仍然在犯这些错误,而没有意识到从长远来看,这些错误可能会损害他们的数据生涯。
如果我的5条麦肯锡教给我的让你成为更好的数据科学家的经验教训是我从最好的方面学到的,那么本文中的经验教训是我辛苦学到的,我希望我能帮助你避免犯同样的错误。
在成长过程中,人们总是根据我们如何遵守规则和秩序来评价我们,尤其是在学校里。如果你遵循课本,练习考试,只要投入艰苦的学习,你就会成为优等生。许多人似乎把这种“步兵”的心态带到了他们的工作环境中。在我看来,正是这种心态阻碍了许多数据科学家最大限度地发挥他们的影响,并从同行中脱颖而出。我观察到很多DS,尤其是低年级的DS,认为他们对决策过程没有什么贡献,宁愿退居二线,被动地执行为他们做出的决策。这引发了一个恶性循环--你对这些讨论的贡献越少,利益相关者就越不可能让你参与未来的会议,你在未来做出贡献的机会也就越少。
让我给你一个具体的例子,在模型开发的情况下,一个步兵和一个思想伙伴之间的区别。在数据收集和功能集思广益会议中,以前的我总是被动地记录涉众的建议,这样我就可以在以后“完美”地实现它们。当有人提出一个特性,我知道我们没有数据,我不会说任何基于假设,他们更资深,他们一定知道一些我忽略了。但你猜怎么着,他们没有。我后来会面临这样的情况,即我们集思广益的50%的特性将需要额外的数据收集,这将危及我们的项目截止日期。结果,我经常发现自己最终处于坏消息传递者的不受欢迎的位置。如今,我努力成为一个思想伙伴,我在谈话的早期就参与进来,并利用我作为最接近数据的人的独特地位。通过这种方式,我可以在早期管理涉众的期望,并提出建议来帮助团队前进。
如何避免这种情况:
我想成为一名数据工程师还是数据科学家?我想处理市场和销售数据还是地理空间分析?您可能已经注意到,到目前为止,我在本文中一直使用术语DS作为许多与数据相关的职业道路(例如,数据工程师、数据科学家、数据分析师等)的通用术语。这是因为在当今的数据世界中,这些标题之间的界限是如此模糊,尤其是在较小的公司中。我观察到许多数据科学家认为自己只是构建模型的数据科学家,而不关注任何业务方面,或者数据工程师只关注数据管道,而不想知道公司正在进行的任何建模。
最好的数据人才是那些能够身兼数职或至少能够理解其他数据角色的流程的人。如果您想在早期阶段或成长阶段的初创企业工作,这尤其方便,因为那里的功能可能还没有那么专业化,而且您需要灵活并涵盖各种与数据相关的职责。即使你在一个明确定义的工作概要中,随着时间的推移,你获得了更多的经验,你可能会发现你有兴趣过渡到一个不同类型的数据角色。如果你不把自己和你的技能归类于一个特定角色的狭隘焦点,这个支点会容易得多。
如何避免这种情况:
自满扼杀生命
每个士兵都知道这一点,每个DS也应该知道。对自己的数据技能沾沾自喜,而不花时间学习新的技能是一个常见的错误。在数据领域这样做比在其他一些领域更危险,因为数据科学是一个相对较新的领域,仍在经历剧烈的变化和发展。不断有新的算法、新的工具,甚至新的编程语言被引入。
如果你不想成为那个在2021年仍然只知道如何使用STATA的数据科学家(他存在,我和他一起工作过),那么你需要跟上该领域的发展。
如何避免这种情况:
如果你只有一把锤子,那么一切看起来都像钉子。不要是那种试图在所有事情上使用ML的DS。当我第一次进入数据科学的世界时,我对我在学校学到的所有花哨的模型感到非常兴奋,迫不及待地想在现实世界的问题上尝试所有这些模型。但现实世界与学术研究不同,80/20规则总是在发挥作用。
在我之前的一篇关于“麦肯锡教给我的5堂课”的文章中,我写到了商业影响和可解释性有时比你的模型的准确性多出几个百分点更重要。有时,假设驱动的Excel模型可能比多层神经网络更有意义。在这种情况下,不要过度弯曲你的分析肌肉,使你的方法矫枉过正。相反,发挥你的商业实力,做一个同样具有商业头脑的DS。
如何避免这种情况:
在我的文章“建立一个伟大的数据文化的6个基本步骤”中,我写到,如果公司没有一个伟大的数据文化,数据科学家的生活将会变得可怕和毫无成效。事实上,我听到很多DS抱怨没有效率的ad hoc数据请求,这些请求应该由涉众以自给自足的方式轻松处理(例如,在Looker中将聚合从每月改为每天,实际上由两次点击组成)。不要认为改变这种文化是别人的工作。如果你想看到变化,就去做。毕竟,谁比数据科学家本身更有能力构建数据文化,并教育利益相关者了解数据?帮助建立公司中的数据文化将使您以及您的利益相关者的生活变得更加轻松。
如何避免这种情况:
我确实想指出,在你的职业生涯中犯错是可以的。最重要的是从这些错误中吸取教训,并在将来避免它们。或者更好的是,把它们写下来帮助别人避免犯同样的错误。
数据分析咨询请扫描二维码
CDA数据分析师在中国航信高科技产业园进行了面向测试度量的数据分析培训课程,培训人数近2 ...
2024-05-01CDA数据分析师走进深圳迈瑞生物医疗电子股份有限公司,在迈瑞总部展开了为期两天的培训,本次课程参训人员线上及线下近百人, ...
2024-05-01CDA数据分析师在合肥市对合肥阳光新能源科技有限公司开展了为期8天的企业内训。 合肥阳光新能源科技 ...
2024-05-01CDA数据分析师走进海尔大学,进行了《数据治理与数据中台建设的道与术》专题培训,培训现场爆满,近百人参加了此次培训。 ...
2024-05-01在中国银行苏州分行培训中心开始数据分析师培训,此次培训课程共10天内容,包括Excel、MySQL、概率论与数理统计、SPSS等内容, ...
2024-05-01从实际的业务需求出发,结合行业的典型应用特点,围绕实际的商业问题,探讨数据挖掘、机器学习模型在金融领域的应用,包括获客、信用评分、细分画像、交叉销售、反欺诈、违规识别、时序预测、运筹优化、流程挖掘九个方面,形成 ...
2024-05-01本次培训课程为线上+线下的模式,由于学员编程能力不一、部分学员没有编程基础,故提供统计学、python基 ...
2024-05-01华夏银行信用卡中心-机器学习培训 1、课程亮点 取材于业界一流企业和顶级咨询公司的行业实践;已经被证明是人人 ...
2024-05-01主 题:数据中台建设及数据分析应用主题分享 1. 数据中台市场洞察 2. 主流数据中台产品比较 3. 某企业数据中 ...
2024-05-01围绕“数据驱动”战略,全力打造我行 300 人数字化人才梯队,着力培养数字化管理人才、大数据专业团队 ...
2024-05-01在当今数据驱动的商业环境中,数据分析成为了企业决策的重要依据。通过对大量数据的收集、处理和分析,企业能够更好地理解市场 ...
2024-04-29在人工智能(AI)的世界里,提示词(Prompt)是一种强大的工具,它能够引导AI按照用户的需求产生特定的输出。本文将深入探讨AI ...
2024-04-29CDA立足未来职场,拓展前沿视野——对外经贸大学保险学院举办“三全育人大讲堂”分享行业最新动态。 ...
2024-04-294月2日,CDA数据分析师创始发起人兼协会理事长赵坚毅博士受邀在浙江万里学院举办了一场以“数字化能力在职场中的作用” ...
2024-04-29随机森林(Random Forests)现在机器学习中比较火的一个算法,是一种基于Bagging的集成学习方法,能够很好地处理分类和回归的问 ...
2022-12-23方差分析是数据分析中常用的一种统计分析方法,接下来让我们简单了解一下方差分析的基本思想和原理吧。 方差分析(Analysis ...
2022-12-23来源:关于数据分析与可视化 关于streamlit-aggrid 数据排序 表格样式的调整 数据 ...
2022-08-03作者:麦叔 定义 「把上面晦涩的概念汇成一句话就是:」 ❝ 回调函数就是一个被作为参 ...
2022-08-03现今,高学历人群日益增多,物以稀为贵的高学历光环淡去。无论本科生还是研究生,甚至博士生,求职竞争力都大不如前,就业压力越来越大。
2022-06-01某家企业10个人面试,有9个本科生……如何脱颖而出,除得体的举止和良好的沟通力外,证书成重要筹码,这也是很多人考证的关键所在。
2022-04-14