
你真的适合在数据科学领域工作吗_数据分析师考试
目前数据科学家或相关角色(如数据管理,统计师,数据分析师等)成为最抢手的职业之一。针对这一跨行业的趋势,一些顶尖大学已经开始致力于培养数据科学家。---cda数据分析师报名
在更多的机遇、薪酬、知名度以及商业领袖们对它重视的诱惑下,许多人开始朝着数据科学家的职业努力,但他们并没有深入地思考这个职位每天所需要承担的责任、需要的态度、在技术和商业技能上的平衡的能力。
对于有志成为数据科学家这个角色的人,这些能够挑战自我和职业抱负的人,我们希望能勾画出一个清晰的图像来说明这些人的特质。我最近同一个有着25年以上行业经验的人Paco Nathan聊起这个问题,他的坦诚的回应让我对这个问题的认识清楚了不少。
Anmol Rajpurohit: 数据科学家被称为第二十一世纪最性感的工作。你同意吗?你会给致力于从事数据科学的人们什么样的建议呢?
Paco Nathan:我不同意。没有多少人具备数据科学家这个角色所需要的知识广度,也没有多少人具备掌握这些技能必备的耐心和欲望。
先做一个自我测试吧
1、准备一个未知的数据集的分析和可视化,数据需求者们将看到你的成果后问一些关键问题,但你要准备好你满怀信心得出的结果受到一些量化的论证。
2、在25个字以内形容出损失函数(loss function)和(regularization term)正则化项,用几个例子做比较/对比,并展示如何为建模说明(model transparency)、模型预测能力和资源需求构建一系列的权衡。
3、在行政机关工作人员会议上提出一个关于解雇排名靠后的人的企业重整建议。
4、访问34个对你的项目有敌视态度的不同部门,梳理出他们一直不愿意提供的元数据资料。
5、构建、测试和部署一个APP,可以提供实时的SLAs,同时可以有效地跨越1000多节点集群。
6、在没有他人帮助的情况下,解决一个至少有200字节长的会出现间歇性错误的代码问题。
7、利用集成方法,提升你正在做一个预测模型的效果。
8、在最后期限日之前,和来自34个和你工作毫不相关的领域的人们一起完成编程项目。
如果你不喜欢上面任何一项工作,那么我建议你不要把“数据科学家”当成你的职业。
数据科学家这个“性感”的角色是大约在2012年由DJ Patil, Hilary Mason等人提出的,然而不是每个人都能分到这个40亿美元产业的一杯羹。
2012年的状况和现在已经有很大的区别,现在在数据科学领域工作意味着:
1、在待开发的领域里有一些创新的机会,但不是经常会有。
2、大多数现有的项目是有风险的。
3、必须对一些权威提出挑战(这不好玩,但是是这个角色的精髓)。
DJ和其他人之前所做的,大多数同数据相关的问题是社会或者组织(例如,数据孤岛,缺乏元数据,矩阵组织内讧等)或者是组织里对这个问题已经有了明确的回答。
我有一种预感,在电子商务领域已经有很多有趣的工作出现,优秀的人们将继续保持极高的价值,但是工作将向硅谷外转移,或者是其他行业的人们将来这里进行学习、合作、交易等等。
例如Monsanto(一家位于美国密苏里州的巨型跨国农业生物技术公司),他们在旧金山成立了一个公司,其实他们可以投资更多的钱在拥有更有利条件的公司上,正如其他风险投资(VC)所做的。然而,该地区的风险投资人(VC)却忽略了相关数据在企业的重要作用——除了特斯拉(Khosla)。在过去的几个月中,他们已经收购了:Climate Corp, Solum等等,我期待着这种趋势的发展。
(Climate Corp 是一家意外天气保险公司,为美国的农民提供天气意外保险。Solum是一家农业领域的科技创业公司,它们的测量系统能够实现更高效、更精准的农产品抽样分析。)
从我的角度来看,数据最大的问题还没有出现,它应该解决真正的问题,例如食品供应,干旱/洪水,能源安全,医疗保健,电信,交通运输减少对石油的依赖,更智能的生产,森林砍伐监测,海洋分析等等。
此外,IT预算仍然限制了数据的洞察力。太多的预算流向了“数据工程“人员,太多的预算往往被指定用于已经清理的数据。另外,我发现,在SV中“产品管理”的概念同有效利用数据的概念是对立的,在许多情况下,产品管理会阻碍公司数据的使用。cda数据分析师考试
因此,我们的价值一般会体现在以下几个方面:
1、编写代码来准备数据。
2、用自动化流程来提高工程的性能和模型比赛。
3、对权威用数据进行挑战。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
MySQL 服务器内存碎片:成因、检测与内存持续增长的解决策略 在 MySQL 运维中,“内存持续增长” 是常见且隐蔽的性能隐患 —— ...
2025-09-24人工智能重塑工程质量检测:核心应用、技术路径与实践案例 工程质量检测是保障建筑、市政、交通、水利等基础设施安全的 “最后一 ...
2025-09-24CDA 数据分析师:驾驭通用与场景指标,解锁数据驱动的精准路径 在数据驱动业务的实践中,指标是连接数据与决策的核心载体。但并 ...
2025-09-24在数据驱动的业务迭代中,AB 实验系统(负责验证业务优化效果)与业务系统(负责承载用户交互与核心流程)并非独立存在 —— 前 ...
2025-09-23CDA 业务数据分析:6 步闭环,让数据驱动业务落地 在企业数字化转型中,CDA(Certified Data Analyst)数据分析师的核心价值,并 ...
2025-09-23CDA 数据分析师:以指标为钥,解锁数据驱动价值 在数字化转型的浪潮中,“用数据说话” 已成为企业决策的共识。但数据本身是零散 ...
2025-09-23当 “算法” 成为数据科学、人工智能、业务决策领域的高频词时,一种隐形的认知误区正悄然蔓延 —— 有人将分析结果不佳归咎于 ...
2025-09-22在数据分析、金融计算、工程评估等领域,“平均数” 是描述数据集中趋势最常用的工具之一。但多数人提及 “平均数” 时,默认指 ...
2025-09-22CDA 数据分析师:参数估计助力数据决策的核心力量 在数字化浪潮席卷各行各业的当下,数据已成为驱动业务增长、优化运营效率的核 ...
2025-09-22训练与验证损失骤升:机器学习训练中的异常诊断与解决方案 在机器学习模型训练过程中,“损失曲线” 是反映模型学习状态的核心指 ...
2025-09-19解析 DataHub 与 Kafka:数据生态中两类核心工具的差异与协同 在数字化转型加速的今天,企业对数据的需求已从 “存储” 转向 “ ...
2025-09-19CDA 数据分析师:让统计基本概念成为业务决策的底层逻辑 统计基本概念是商业数据分析的 “基础语言”—— 从描述数据分布的 “均 ...
2025-09-19CDA 数据分析师:表结构数据 “获取 - 加工 - 使用” 全流程的赋能者 表结构数据(如数据库表、Excel 表、CSV 文件)是企业数字 ...
2025-09-19SQL Server 中 CONVERT 函数的日期转换:从基础用法到实战优化 在 SQL Server 的数据处理中,日期格式转换是高频需求 —— 无论 ...
2025-09-18MySQL 大表拆分与关联查询效率:打破 “拆分必慢” 的认知误区 在 MySQL 数据库管理中,“大表” 始终是性能优化绕不开的话题。 ...
2025-09-18DSGE 模型中的 Et:理性预期算子的内涵、作用与应用解析 动态随机一般均衡(Dynamic Stochastic General Equilibrium, DSGE)模 ...
2025-09-17Python 提取 TIF 中地名的完整指南 一、先明确:TIF 中的地名有哪两种存在形式? 在开始提取前,需先判断 TIF 文件的类型 —— ...
2025-09-17CDA 数据分析师:解锁表结构数据特征价值的专业核心 表结构数据(以 “行 - 列” 规范存储的结构化数据,如数据库表、Excel 表、 ...
2025-09-17Excel 导入数据含缺失值?详解 dropna 函数的功能与实战应用 在用 Python(如 pandas 库)处理 Excel 数据时,“缺失值” 是高频 ...
2025-09-16深入解析卡方检验与 t 检验:差异、适用场景与实践应用 在数据分析与统计学领域,假设检验是验证研究假设、判断数据差异是否 “ ...
2025-09-16