
5年前,“数据科学家”的工作描述还不存在。没人刊登招聘启示寻找数据科学领域里的专家,你在学校里也找不到这个专业。现在,雇主们正在争夺这些专家,而培养这些专家的课程在众多大学里开始层出不穷。《哈佛商业评论》(Harvard Business Review)甚至声称数据科学家是21世纪“最性感”的工作。
数据科学家取得海量数据,试图从中找出有用的信息。这项工作综合了统计学和编程,来鉴别出可能对一家公司的营收有巨大影响的因素——有时可能是微妙的因素,从某人是否会点击某类广告,到一种新的化学物在人体中是否有毒性。
华尔街、麦迪逊大道、底特律一直以来都聘用数据专家来分析商业数据。这个专业技能的出现反应了目前在一些行业里数据的规模和种类的扩展,比如网络上有关顾客的数据收集。现有的数据比单个经理们能够应付的量大太多、变化太快,以至于用传统方法难以分析。
智能手机的出现让零售商们看到了一个新的提供有价值数据的来源。举例来说,沃尔玛正在争夺引进更多的数据科学家,为其数十个职位刊登招聘广告,包括“处理大而快的数据的工程师”。工厂和工业设备上的传感器也在传输堆积如山的新数据,促使GE聘用数据科学家分析这些数据。
“数据科学家”这个称号是在2008年由当时在LinkedIn和Facebook工作的两名数据分析师发明的。现在许多创业公司正把自己的业务基于分析大量数据的能力——通常是来自不同源头的数据。比如,ZestFinance有一个预测模型,使用成千上万的变量来决定借贷商是否应当提供高风险贷款。该公司的数据科学家约翰·坎迪多(John Candido)说,这个模型使得承保风险比传统借贷商承担的风险低了40%。“对我们而言,所有数据都是贷款数据。”
杰克·克拉姆卡(Jake Klamka)提供一个6周的研究职位,帮助把来自数学、天体物理甚至神经科学领域的博士生们放到数据科学的职位上。他说,数据科学家已经变成一个流行的职位名称,部分是因为它把越来越多随意命名和重叠的工作角色归结在了一起。“我们这里各个领域的人都有,在他们的研究中都要处理大堆的数据,”他说,“他们需要知道如何编程,同时也需要强大的沟通技能和好奇心。”
对于最好的数据科学家,创造力和编程能力同样重要。Kaggle公司组织竞赛鼓励数据科学家发现分析海量数据集的最佳方法。公司执行长安东尼·戈德布卢姆(Anthony Goldbloom)说,那些拔尖的参赛者(该公司网站上有8.8万名注册参赛者)中,许多都来自天体物理学或电子工程领域。目前排名最高的参赛者是新加坡的一名精算师。
大学院校正开始响应市场的需求。斯坦福大学统计系主任冈瑟·沃尔瑟(Guenther Walther)说,学校计划在该系开设数据科学硕士学位。哥伦比亚大学、加州大学旧金山分校等学校已经开设了约几十个相关课程。Cloudera公司销售的软件可以处理和组织大规模数据。该公司在4月宣布将和7所大学合作,在本科课程中提供如何运用“大数据”技术的专业训练。
Cloudera的教育项目主管马克·莫里赛(Mark Morissey)说,技能短缺问题正在逼近,“市场不会以它目前想要的速度成长”。这推动了工资的上涨。在硅谷,刚入行的数据科学家的薪酬为11万到12万美元。
其他人认为这个趋势可能创造新的外包领域。目前在Kaggle的分数榜上排名第20位的沙希·戈德博尔(Shashi Godbole)是一名来自印度孟买的数据科学家,他最近完成了由Kaggle安排的一个按小时计酬的顾问工作。这是Kaggle目前正在发展中的新业务。戈德博尔为芝加哥的一个小型健康倡导非营利机构工作,现在还在投标其他工作。(他每小时赚取200美元,Kaggle从中赚300美元)。他在Kaggle的这些工作目前还是兼职,但他说,有朝一日它可能变成他的主要收入来源。
在数据科学家们自己看来,这个工作当然不像人们“粉饰”得那么性感。Cloudera的资深数据科学主管乔希·威尔斯(Josh Wills)说,自己的大部分时间都花在清理混乱的数据,比如把数字放到正确的栏中,开始筛选。
“我是个数据门房。这就是21世纪最性感的工作,”他说,“这么说真让人受宠若惊,但同时也让人有些困惑。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
用 Power BI 制作地图热力图:基于经纬度数据的实践指南 在数据可视化领域,地图热力图凭借直观呈现地理数据分布密度的优势,成 ...
2025-07-24解析 insert into select 是否会锁表:原理、场景与应对策略 在数据库操作中,insert into select 是一种常用的批量数据插入语句 ...
2025-07-24CDA 数据分析师的工作范围解析 在数字化时代的浪潮下,数据已成为企业发展的核心资产之一。CDA(Certified Data Analyst)数据分 ...
2025-07-24从 CDA LEVEL II 考试题型看 Python 数据分析要点 在数据科学领域蓬勃发展的当下,CDA(Certified Data Analyst)认证成为众多从 ...
2025-07-23用 Python 开启数据分析之旅:从基础到实践的完整指南 在数据驱动决策的时代,数据分析已成为各行业不可或缺的核心能力。而 Pyt ...
2025-07-23鸢尾花判别分析:机器学习中的经典实践案例 在机器学习的世界里,有一个经典的数据集如同引路明灯,为无数初学者打开了模式识别 ...
2025-07-23解析 response.text 与 response.content 的核心区别 在网络数据请求与处理的场景中,开发者经常需要从服务器返回的响应中提取数 ...
2025-07-22解析神经网络中 Softmax 函数的核心作用 在神经网络的发展历程中,激活函数扮演着至关重要的角色,它们为网络赋予了非线性能力, ...
2025-07-22CDA数据分析师证书考取全攻略 一、了解 CDA 数据分析师认证 CDA 数据分析师认证是一套科学化、专业化、国际化的人才考核标准, ...
2025-07-22左偏态分布转正态分布:方法、原理与实践 左偏态分布转正态分布:方法、原理与实践 在统计分析、数据建模和科学研究中,正态分 ...
2025-07-22你是不是也经常刷到别人涨粉百万、带货千万,心里痒痒的,想着“我也试试”,结果三个月过去,粉丝不到1000,播放量惨不忍睹? ...
2025-07-21我是陈辉,一个创业十多年的企业主,前半段人生和“文字”紧紧绑在一起。从广告公司文案到品牌策划,再到自己开策划机构,我靠 ...
2025-07-21CDA 数据分析师的职业生涯规划:从入门到卓越的成长之路 在数字经济蓬勃发展的当下,数据已成为企业核心竞争力的重要来源,而 CD ...
2025-07-21MySQL执行计划中rows的计算逻辑:从原理到实践 MySQL 执行计划中 rows 的计算逻辑:从原理到实践 在 MySQL 数据库的查询优化中 ...
2025-07-21在AI渗透率超85%的2025年,企业生存之战就是数据之战,CDA认证已成为决定企业存续的生死线!据麦肯锡全球研究院数据显示,AI驱 ...
2025-07-2035岁焦虑像一把高悬的利刃,裁员潮、晋升无望、技能过时……当职场中年危机与数字化浪潮正面交锋,你是否发现: 简历投了10 ...
2025-07-20CDA 数据分析师报考条件详解与准备指南 在数据驱动决策的时代浪潮下,CDA 数据分析师认证愈发受到瞩目,成为众多有志投身数 ...
2025-07-18刚入职场或是在职场正面临岗位替代、技能更新、人机协作等焦虑的打工人,想要找到一条破解职场焦虑和升职瓶颈的系统化学习提升 ...
2025-07-182025被称为“AI元年”,而AI,与数据密不可分。网易公司创始人丁磊在《AI思维:从数据中创造价值的炼金术 ...
2025-07-18CDA 数据分析师:数据时代的价值挖掘者 在大数据席卷全球的今天,数据已成为企业核心竞争力的重要组成部分。从海量数据中提取有 ...
2025-07-18