京公网安备 11010802034615号
经营许可证编号:京B2-20210330
当我第一次从金融学过渡到数据科学时,我觉得自己就像站在了世界之巅--我在我梦想的领域找到了一份工作,我的职业轨迹已经确定,我只会低着头努力工作,哪里会出错?嗯,有几件事……在接下来的一年里,作为一名数据科学家,我很高兴我发现自己在职业生涯早期犯了几个错误。这样,我就有时间在为时已晚之前进行反思和纠正。过了一会儿,我意识到这些错误是相当普遍的。事实上,我已经观察到我周围的很多DS仍然在犯这些错误,而没有意识到从长远来看,这些错误可能会损害他们的数据生涯。
如果我的5条麦肯锡教给我的让你成为更好的数据科学家的经验教训是我从最好的方面学到的,那么本文中的经验教训是我辛苦学到的,我希望我能帮助你避免犯同样的错误。
在成长过程中,人们总是根据我们如何遵守规则和秩序来评价我们,尤其是在学校里。如果你遵循课本,练习考试,只要投入艰苦的学习,你就会成为优等生。许多人似乎把这种“步兵”的心态带到了他们的工作环境中。在我看来,正是这种心态阻碍了许多数据科学家最大限度地发挥他们的影响,并从同行中脱颖而出。我观察到很多DS,尤其是低年级的DS,认为他们对决策过程没有什么贡献,宁愿退居二线,被动地执行为他们做出的决策。这引发了一个恶性循环--你对这些讨论的贡献越少,利益相关者就越不可能让你参与未来的会议,你在未来做出贡献的机会也就越少。
让我给你一个具体的例子,在模型开发的情况下,一个步兵和一个思想伙伴之间的区别。在数据收集和功能集思广益会议中,以前的我总是被动地记录涉众的建议,这样我就可以在以后“完美”地实现它们。当有人提出一个特性,我知道我们没有数据,我不会说任何基于假设,他们更资深,他们一定知道一些我忽略了。但你猜怎么着,他们没有。我后来会面临这样的情况,即我们集思广益的50%的特性将需要额外的数据收集,这将危及我们的项目截止日期。结果,我经常发现自己最终处于坏消息传递者的不受欢迎的位置。如今,我努力成为一个思想伙伴,我在谈话的早期就参与进来,并利用我作为最接近数据的人的独特地位。通过这种方式,我可以在早期管理涉众的期望,并提出建议来帮助团队前进。
如何避免这种情况:
我想成为一名数据工程师还是数据科学家?我想处理市场和销售数据还是地理空间分析?您可能已经注意到,到目前为止,我在本文中一直使用术语DS作为许多与数据相关的职业道路(例如,数据工程师、数据科学家、数据分析师等)的通用术语。这是因为在当今的数据世界中,这些标题之间的界限是如此模糊,尤其是在较小的公司中。我观察到许多数据科学家认为自己只是构建模型的数据科学家,而不关注任何业务方面,或者数据工程师只关注数据管道,而不想知道公司正在进行的任何建模。
最好的数据人才是那些能够身兼数职或至少能够理解其他数据角色的流程的人。如果您想在早期阶段或成长阶段的初创企业工作,这尤其方便,因为那里的功能可能还没有那么专业化,而且您需要灵活并涵盖各种与数据相关的职责。即使你在一个明确定义的工作概要中,随着时间的推移,你获得了更多的经验,你可能会发现你有兴趣过渡到一个不同类型的数据角色。如果你不把自己和你的技能归类于一个特定角色的狭隘焦点,这个支点会容易得多。
如何避免这种情况:
自满扼杀生命
每个士兵都知道这一点,每个DS也应该知道。对自己的数据技能沾沾自喜,而不花时间学习新的技能是一个常见的错误。在数据领域这样做比在其他一些领域更危险,因为数据科学是一个相对较新的领域,仍在经历剧烈的变化和发展。不断有新的算法、新的工具,甚至新的编程语言被引入。
如果你不想成为那个在2021年仍然只知道如何使用STATA的数据科学家(他存在,我和他一起工作过),那么你需要跟上该领域的发展。
如何避免这种情况:
如果你只有一把锤子,那么一切看起来都像钉子。不要是那种试图在所有事情上使用ML的DS。当我第一次进入数据科学的世界时,我对我在学校学到的所有花哨的模型感到非常兴奋,迫不及待地想在现实世界的问题上尝试所有这些模型。但现实世界与学术研究不同,80/20规则总是在发挥作用。
在我之前的一篇关于“麦肯锡教给我的5堂课”的文章中,我写到了商业影响和可解释性有时比你的模型的准确性多出几个百分点更重要。有时,假设驱动的Excel模型可能比多层神经网络更有意义。在这种情况下,不要过度弯曲你的分析肌肉,使你的方法矫枉过正。相反,发挥你的商业实力,做一个同样具有商业头脑的DS。
如何避免这种情况:
在我的文章“建立一个伟大的数据文化的6个基本步骤”中,我写到,如果公司没有一个伟大的数据文化,数据科学家的生活将会变得可怕和毫无成效。事实上,我听到很多DS抱怨没有效率的ad hoc数据请求,这些请求应该由涉众以自给自足的方式轻松处理(例如,在Looker中将聚合从每月改为每天,实际上由两次点击组成)。不要认为改变这种文化是别人的工作。如果你想看到变化,就去做。毕竟,谁比数据科学家本身更有能力构建数据文化,并教育利益相关者了解数据?帮助建立公司中的数据文化将使您以及您的利益相关者的生活变得更加轻松。
如何避免这种情况:
我确实想指出,在你的职业生涯中犯错是可以的。最重要的是从这些错误中吸取教训,并在将来避免它们。或者更好的是,把它们写下来帮助别人避免犯同样的错误。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在 MySQL 查询性能优化体系中,索引是降低查询耗时、提升数据库吞吐的核心手段。其中联合索引与覆盖索引是实际开发中最高频的两 ...
2026-06-15在数据仓库建设与商业智能分析体系中,维度建模是应用最广泛的建模方法论,而事实表与维度表是维度建模的两大核心构件,共同构成 ...
2026-06-15 很多数据分析师能熟练计算指标,但当被问到“这家企业的核心业务目标是什么”“如何把模糊的战略目标拆解为可量化的指标”“ ...
2026-06-15在数据分析、业务监控、运营复盘等场景中,列值趋势计算是核心需求之一。无论是分析销售额的月度增长、用户活跃的变化趋势、库存 ...
2026-06-12在数字经济深度渗透的当下,消费者的购买行为已从过去的 “被动接受” 转变为 “主动决策”。流量红利消退、获客成本攀升、用户 ...
2026-06-12CDA三级认证是三个级别中的塔尖,全面考察数据战略、团队领导和复杂项目的综合能力。它所对应的《敏捷数据挖掘》教材,不再局限 ...
2026-06-12在游戏产业的商业逻辑中,付费玩家是支撑游戏生存与发展的核心支柱。行业普遍遵循 “二八定律”:20% 的付费玩家贡献了游戏 80% ...
2026-06-11【核心关键词】企业、定位、传统、产品、互联网、可视化、业务侧、数字化、结构化、数据分析、传统制造业、市场状态、发展空间 ...
2026-06-11 解读《CDA二级教材:量化策略分析(2025)》的全景结构与学习逻辑 ” CDA二级认证是企业招聘数据分析师时最常提及的证书门槛 ...
2026-06-11【核心关键词】药企、可视化、营销、分类、数据分析师、销售数据、业务人员、指导方向、分析报告、营销数据、营销医生 【专访摘 ...
2026-06-10在统计学分析、问卷调研、实验验证、业务复盘等场景中,卡方检验与 T 检验是应用最广泛的两类基础假设检验方法。前者专门处理分 ...
2026-06-10 很多数据分析师每天都在计算指标、制作报表,但当被问到“什么叫指标数据元”“指标数据标准包含哪些核心维度”“指标数据质 ...
2026-06-10在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-06-08【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05