京公网安备 11010802034615号
经营许可证编号:京B2-20210330
大数据专才:“走俏”变“紧缺”_数据分析师培训
应对大数据时代的挑战,国内学术界最近动静不小。中科院院士马志明说,上月他每周都在见证一家全新的、和大数据相关的研究机构或研究平台诞生。从中科院系统内部培育的重点实验室到国家基金委的“双清论坛”,再到日前上海财经大学携手国家统计局成立“大数据统计科学中心”—一个信号已经非常清晰:对大数据的深挖和系统研究,已是板上钉钉的国家战略。
“在大数据时代,数据科学家和数据工程师非常紧缺。”根据一些机构的测算,未来5年,国内各行各业需要的大数据专业人才,缺口将高达1000万左右。
对海量数据信息的处理手段还远不够
大数据正给各行各业带来巨变。以保险业的车险为例,如果在每辆汽车上加载一个行驶监测设备,保险公司就可以轻松掌握每一个用户的车辆使用情况、个人驾驶习惯等。基于这些关键数据,保险公司就可以针对不同的用户“定制”不同的车险品种,从而提高投保的精准率。
上海财经大学统计与管理学院院长周勇教授说,无论是学术界还是企业界都已察觉,大数据是一座“富矿”,对大数据的收集、深挖过程,本身就伴随着很多的发展机会。
但开掘“富矿”并不容易。比如,对海量数据信息的处理手段,目前还远远不够。有业内人士做过测算,假设一个城市有3万个左右摄像头,在不经任何加工的情况下原始保存连续两个月的图像信息,耗资将高达上百亿元人民币。除了要解决数据存储的基础设施问题,如何从海量的图像信息中提取有效信息,也是目前学界正在加紧研究的课题。
“过去10年至15年来,基于互联网的信息技术革命已给全人类带来了颠覆性影响,信息科学从某种程度上说,已成为推动经济发展的一个重要引擎。现在还可以预见的是:在未来的几十年时间里,更多与经济社会发展相关的决策,都会被大数据推着走。”美国普林斯顿大学终身教授、上海财经大学大数据统计科学中心首席科学家范剑青教授说,对大数据的研究固然涉及众多学科、领域,但按照目前美国学术界的共同看法,数学、统计学和计算机科学的三者结合是构成分析、研究大数据的基础。
研究机构比企业更缺大数据专业人才
随着大数据时代的到来,专业数据处理人才已从“走俏”变成“紧缺”。“过去我们的毕业生一般喜欢到金融机构、保险机构等单位就业,做一些和数据分析相关的工作。但现在,互联网公司、大型药企都开出高薪抢人。”周勇说。颇有意思的是,来自企业的高薪揽才,客观上让学术界“尴尬”:“现在最需要、最缺少大数据专业人才的其实是高校和研究机构。高起点、高水平的研究亟需高层次的人才加盟,但因为科研机构的待遇不如企业,留住人才成了一桩难事。”
大数据“捧红”了作为传统学科的统计学;但另一方面,统计学受到的来自大数据的挑战,也比其他学科要猛烈得多。
“在大数据时代,很多传统的数据收集方法、统计方法显得失效,而且用统计的手段进行经济预测的功能,也出现了根本性的变革。”据介绍,国家统计局目前已经在和百度、阿里巴巴等互联网公司合作,深度开发挖掘大量实时在线的搜索数据,从而提升统计数据的准确性和及时性。过去,统计数据对经济走势预测、对宏观决策的作用往往是“用过去的经验来预测未来”,而今后,“经济雷达”在预测、预警时发挥的功效会显得更具时效性。
“有了互联网、大数据,收集信息的渠道和时效明显增强,无论是专业的统计部门还是智库,不用再为拿不到真实数据而烦恼了。”也有一位统计学专家告诉记者,虽然数据来源多样、获取渠道多样是大数据时代的“红利”,但它同时也滋生出信息安全、用户隐私权保护方面的新问题。
“学界与业界对大数据带来的变革和挑战有不同层次的关注、感受,业界有强烈的问题驱动,学界则对面临的学术任务非常明晰。”上海财经大学校长樊丽明说,上海财大此次联合国家统计局成立“大数据统计科学中心”,初衷就是聚焦国家战略,形成在大数据研究、社会经济统计等领域的合作研究项目,以学校的优势学科服务上海科创中心建设。文章来源:CDA数据分析师培训官网
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
主讲人简介 张冲,海归统计学硕士,CDA 认证数据分析师,前云南白药集团资深数据分析师,自媒体 Python 讲师,全网课程播放量破 ...
2026-04-10在数据可视化与业务分析中,同比分析是衡量业务发展趋势、识别周期波动的核心手段,其核心逻辑是将当前周期数据与上年同期数据进 ...
2026-04-10在机器学习模型的落地应用中,预测精度并非衡量模型可靠性的唯一标准,不确定性分析同样不可或缺。尤其是在医疗诊断、自动驾驶、 ...
2026-04-10数据本身是沉默的,唯有通过有效的呈现方式,才能让其背后的规律、趋势与价值被看见、被理解、被运用。统计制图(数据可视化)作 ...
2026-04-10在全球化深度发展的今天,跨文化传播已成为连接不同文明、促进多元共生的核心纽带,其研究核心围绕“信息传递、文化解读、意义建 ...
2026-04-09在数据可视化领域,折线图是展示时序数据、趋势变化的核心图表类型之一,其简洁的线条的能够清晰呈现数据的起伏规律。Python ECh ...
2026-04-09在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-04-09长短期记忆网络(LSTM)作为循环神经网络(RNN)的重要改进模型,凭借其独特的门控机制(遗忘门、输入门、输出门),有效解决了 ...
2026-04-08在数据分析全流程中,数据质量是决定分析结论可靠性的核心前提,而异常值作为数据集中的“异类”,往往会干扰统计检验、模型训练 ...
2026-04-08在数字经济飞速发展的今天,数据已渗透到各行各业的核心场景,成为解读趋势、优化决策、创造价值的核心载体。而数据分析,作为挖 ...
2026-04-08在数据分析全流程中,数据处理是基础,图形可视化是核心呈现手段——前者负责将杂乱无章的原始数据转化为干净、规范、可分析的格 ...
2026-04-07在数据分析与统计推断中,p值是衡量假设检验结果显著性的核心指标,其本质是在原假设(通常为“无效应”“无差异”)成立的前提 ...
2026-04-07在数字经济深度渗透的今天,数据已成为企业生存发展的核心资产,企业的竞争本质已转变为数据利用能力的竞争。然而,大量来自生产 ...
2026-04-07Python凭借简洁的语法、丰富的生态库,成为算法开发、数据处理、机器学习等领域的首选语言。但受限于动态类型、解释性执行的特性 ...
2026-04-03在深度学习神经网络中,卷积操作是实现数据特征提取的核心引擎,更是让模型“看懂”数据、“解读”数据的关键所在。不同于传统机 ...
2026-04-03当数字化转型从企业的“战略口号”落地为“生存之战”,越来越多的企业意识到,转型的核心并非技术的堆砌,而是数据价值的深度挖 ...
2026-04-03在日常办公数据分析中,数据透视表凭借高效的汇总、分组功能,成为Excel、WPS等办公软件中最常用的数据分析工具之一。其中,“计 ...
2026-04-02在数字化交互的全场景中,用户的每一次操作都在生成动态的行为轨迹——电商用户的“浏览商品→点击详情→加入购物车”,内容APP ...
2026-04-02在数字化转型深度推进的今天,企业数据已成为驱动业务增长、构建核心竞争力的战略资产,而数据安全则是守护这份资产的“生命线” ...
2026-04-02在数据驱动决策的浪潮中,数据挖掘与数据分析是两个高频出现且极易被混淆的概念。有人将二者等同看待,认为“做数据分析就是做数 ...
2026-04-01