京公网安备 11010802034615号
经营许可证编号:京B2-20210330
当我第一次申请l时,我想同时成为一名自由职业者和一名“真正的ML工程师”。
在此之前,我在Nordeus担任机器学习工程师,Nordeus是一家顶级移动游戏公司,以其旗舰游戏TopEleven上有穆里尼奥的脸而闻名。我在Nordeus的机器学习经历包括设计和实现一个智能系统,以帮助客户支持团队更快地解决玩家问题。它的本质是从大量的历史球员门票和代理决议中构建一个文本分类器。
我考虑了整个系统,数据(至少我是这么想的),以及对GPU的访问。从纸面上看,一切似乎都对我来说刚刚好,可以展示一个伟大的模型和一个更好的解决方案。
但这从未发生过。令我绝望的是,我花了一个多月的时间才意识到,我试图用来训练我的监督模型的数据集已经非常糟糕了。在意识到这一点之前,我花了数不清的时间和Jupyter笔记本试图让整个事情运转起来。我工作太忙了,抽不出时间看资料。我们可以说我缺乏经验没有帮助。
在这个失败的项目三个月后,我决定辞去工作,在Toptal开始我的自由职业之路。经过几轮面试和技术筛选,我进入了最后一轮。猜猜看?我得解决一个机器学习作业。几乎和我以前失败的那个一模一样。我有一周的时间来完成它。
很难描述那一周我不得不与之作斗争的消极自我谈话的数量。冒名顶替综合症的长长的阴影迷惑了我的头脑。
这一章有一个圆满的结局。我很好地解决了这个问题,我进入了托普塔尔。三年10个项目后,我可以说我处理冒名顶替综合症好多了。
勇敢是对你帮助最大的事情。自由职业者是勇敢的。如果你想了解更多,请查看我以前关于如何成为自由数据科学家的文章。
当你作为自由职业者/承包商工作时,来自你工作的反馈不会出现在季度或年度审查中。它每天都来。没有办法破解。客户期望您提供质量和快速。顺便说一句,这就是为什么你会比在目前的工作中得到更好的报酬的主要原因。
一旦你觉得你已经掌握了ML的基本原理,就把自己放在拳击台上。考验你自己。你很聪明,你能做到。参加更多的在线课程并不能让冒名顶替综合症消失。相信我.
IMHO排名前2的自由职业平台是
由于数据(大写字母,是的),ML工程比传统软件工程更难。
很少有机会给你一套完整的特性和标签来构建你的ML模型。相反,您通常需要自己生成训练数据。在这个意义上,我遇到的最常见的问题是:
数据是推动所有模型的神奇成分,从简单的线性回归到巨大的变压器模型。如果燃料不好,你开哪辆车都无关紧要。你不打算搬家。
这听起来如此琐碎和愚蠢,以至于我们(我包括我自己)ML工程师有一种令人惊讶的忘记的倾向。当您获得更多构建ML解决方案的经验时,您会更好地记住这一点,并在遇到问题时返回数据。
不能使用Stackoverflow调试数据集。你一个人在那里。你需要改变你的心态。你必须表现得像个解决问题的人。您需要了解数据集,最好的方法是将其可视化。我个人喜欢Tableau Desktop,但也有其他选择,如Power BI、Apache Superset等。如果您愿意,甚至还有Python库,如SweetViz。
无论您喜欢哪种工具,每次卡住时都要返回数据。
机器学习是一个涵盖广泛技术复杂性的领域:软件开发、操作化(MLOps)、经典ML、深度学习的前沿研究、硬件优化…
如果你试图掩盖一切,你会失去焦点,在表面上游荡太多。了解ML中的某些内容意味着您已经自己实现了它。句号。
例如,跟上DL的最新进展是非常棒的。但要有原则地去做。为自己设定一个明确的目标(例如,我想成为变压器模型的专家),并为自己建立一条通往该目标的道路,选择相关的论文、图书馆、网络研讨会,甚至会议。
从一个话题跳到另一个话题让你很忙但注意力不集中。保持谦逊。从小处着手,集中精力。一旦你到达那里,迈出下一步,征服另一个领域。
克服你的恐惧是每天(全职)的工作。不仅仅是在机器学习中,而是在你生活的每个方面,在这些方面你希望明天成长和变得更好。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数字化经营时代,企业的市场竞争早已从经验决策转向数据决策。门店营收、用户转化、产品销量、成本损耗、存量资产等所有经营行为 ...
2026-05-22在MySQL数据库日常运维、业务数据校验、数据迁移与数据清洗场景中,自增主键ID的连续性校验是一项基础且关键的工作。MySQL的Auto ...
2026-05-22 很多企业团队并非缺乏指标,而是陷入“指标失控”:仪表盘上堆满实时跳动的数据,却无法回答“当前瓶颈在哪、下一步该做什么 ...
2026-05-22【核心关键词】大数据、可视化、存储、架构、客户、离线、产品、同步、实时、数据仓库、数据分析、数据可视化、存储数据、离线 ...
2026-05-21在电商流量红利消退、公域获客成本持续走高的当下,存量用户深度挖掘已成为店铺增收增效的核心抓手。相较于付费投放获取的陌生新 ...
2026-05-21 很多数据分析师每天盯着几十个指标,但当被问到“这套指标要支撑什么业务目标”“指标之间是什么逻辑关系”“业务变化时如何 ...
2026-05-21在数据驱动决策的时代,数据质量直接决定分析结果的可靠性与准确性,而异常值作为数据清洗中的核心痛点,往往会扭曲分析结论、误 ...
2026-05-20 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-05-20Agent的能力边界,很大程度上取决于其掌握的Skill质量和数量。传统做法是靠人工编写和维护Skill,但这条路很快会遇到瓶颈。业务 ...
2026-05-20在统计分析中,方差分析(ANOVA)是一种常用的假设检验方法,核心用于分析“一个或多个自变量对单个因变量的影响”,广泛应用于 ...
2026-05-19 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-05-19想高效备考 CDA 一级,拒绝盲目刷题、冗余学习?《CDA 一级教材知识手册》重磅来袭!以官方教材为核心,浓缩 13 章 103 个核心考 ...
2026-05-19在数据统计分析中,卡方检验是一种常用的非参数检验方法,核心用于判断两个或多个分类变量之间是否存在显著关联,广泛应用于市场 ...
2026-05-18在企业数字化转型的浪潮中,很多企业陷入了“技术堆砌”的误区——上线了ERP、CRM、BI等各类系统,积累了海量数据,却依然面临“ ...
2026-05-18小陈是某电商平台的数据分析师。老板交给他一个任务:“我们平台的注册用户已经突破1000万了,想了解一下用户的平均月消费金额。 ...
2026-05-18【专访摘要】本次CDA持证专访邀请到拥有丰富物流供应链数据分析经验的赖尧,他结合自身在京东、华莱士、兰格赛等企业的从业经历 ...
2026-05-15在数字化时代,企业的每一次业务优化、每一项技术迭代,都需要回答一个核心问题:这个动作到底能带来多少价值?是提升了用户转化 ...
2026-05-15在数据仓库建设中,事实表与维度表是两大核心组件,二者相互关联、缺一不可,共同构成数据仓库的基础架构。事实表聚焦“发生了什 ...
2026-05-15 很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问 ...
2026-05-15【核心关键词】互联网、机会、运营、关键词、账户、数字化、后台、客户、成本、网络、数据分析、底层逻辑、市场推广、数据反馈 ...
2026-05-14