京公网安备 11010802034615号
经营许可证编号:京B2-20210330
想要成为数据分析师,需要学什么
我想要成为一名数据分析师,可是数据分析师需要学些什么东西?
数据分析师分布在不同行业中,专门从事行业数据搜集、整理、分析,并依据数据做出行业研究、评估和预测。数据分析师需要敏锐的数字洞察力,因此,统计、会计、保险、工程经济、金融、数学、计算机等专业的同学对这个行业有明显优势,但其他行业的同学如果对这个职业感兴趣,通过日常学习,掌握一些统计必备技能,亦可以从事此类工作.
数据分析师主要工作领域:
1、从事投资项目审核审批和招商引资、项目评估、投资决策等工作的政府机构、企业的相关领导以及从业人员。
2、在银行或非银行金融机构、投资管理公司、投资管理顾问公司从事风险投资、产业投资、信贷和投资管理等方面工作的专业从业人员。
3、会计师事务所、资产评估事务所及税务师事务所、律师相关专业人员。
4、学习财务、统计、投资、金融和企业管理等相关专业的在校应届学生。
5、在企事业单位从事市场调查与宣传工作的人士以及具有策划与决策工作职能要求的人士。
6、在不同领域尝试创业以及在投资、金融、资本运营、房地产和企业管理领域发展的各界人士。
数据分析师的工作内容分为四个层面:
1、处理临时需求:解决业务一次性,临时性的数据需求
2、报表开发:根据业务需要,与开发工程师讨论进行相关报表开发。
3、数据分析与挖掘:与业务同事一起沟通,分析业务问题,提供建议;根据业务需要建立各类挖掘模型。
4、数据产品化:通过数据产品化方式解决结构化业务问题。
数据分析师的基本要求:
1、懂得建立目标
数据分析是为了解决问题而去分析,不是单纯为分析而分析。数据分析是有目的性的。比如:一季度ABC产品的销售情况,是按月份为横坐标建立各部门的图表;各产品线ABC在一季度的销售情况,是按部门为横坐标建立对应的图表。
2、针对不同人群提供不同的结论报告
数据分析要有结论报告,不同的人群报告的侧重点不同。比如管理层,看的是趋势和异常点;营销人员看的是ROI((Return On Investment)产出比率和高用户质量的导入情况;业务人员看的是产品对用户的活跃度等。
3、掌握数据分析工具
如果是互联网数据分析,可以从google GA入门,EXCEL辅助,了解数据分析的基本算法。至于SAS,SPSS这些高级工具不一定需要。
4、不同时期要有不同的KPI(Key Performance Indicator,关键绩效指标)
不断的调整目标和发现问题是数据分析精细化的必经过程。
例如:腾讯的数据分析关键指标集不断调整,从2007年的关注会员基数,到现在的会员活跃度、用户体验度、性能度等等。建立对应的模型,帮助产品和项目的同事更好的了解用户
Q&A如何迅速成长成为一名数据分析师?
如从编程零基础,知道一些简单的统计知识的情况下
回答 Terry Meng,Data Scientist
牧心、朱孝轩、春天已经不远了 等人赞同
从业多年,跨行业,跨专业,跨公司文化,跨地域,觉得有些东西可以分享。
我认为数据分析/数据科学/商业智能(或是其它类似名字)的职业,最核心的部分在于两点:业和术。
“业”更偏向于你的soft skills,你的理解能力,分析能力,沟通能力,mind-set。其中当然包括最重要的一个能力:
将复杂的商业问题转化为数学模型,并利用编程能力进行分析,预测和评估,再转化为合适的Business Plan,执行。
你可以看到,这是一个生态圈,其中并不是只是包含了其它答案所描述的数学模型,统计理论,也不只是包含用什么工具sas,r,excel。总结来说是一种完全设身处地去为商业模型思考的mind-set。这是我很多国内数据从业者身上很少看到的。很多同事更喜欢强调自己的统计模型多好,算法多牛,当然,别理解错,这些优化都是好事,但从一个Business function (我把analytic当作一种服务我们的商业目标的商业职能) 的角度来说,这只是一个从过程中的小部分。这可能是因为很多大型企业,比如银行,电商,IT,智能太细分导致,很少有人能真正退一步去思考我们做分析的意义何在,如何落地,能赚多少钱。
“术”更偏向于你的技术,包括你的数学,统计,编程,硬件的技术。这个技术对很多技术爱好者来说是数据分析最有意思的一部分,但对很多更喜欢business的朋友来说,很乏味。当然,没有好与坏,高级和低级的区别。术业有专攻就是这道理,譬如我们公司,Data science for infrastructure engineering负责数据仓库的朋友工资反而最高。 而抽象一点去说:
为了解决商业问题所需要的技术,能力。
看到这里你应该明白了,很多时候我们说的数据分析师实则是这个层面的。而再细分,这个技术其实分为三层:
1 统计理论,模型
2 数据库查询类编程SQL
3 底层数据存储技术hadoop, hive, spark, etc.
成为一个合格的数据科学家,你需要上面1,2的本事。有能力利用统计模型解决问题,也有能力通过编程将这些模型实现,并且自动化。这里很多人争论SAS,R,Python,SPSS,在我看来,无非只是工具,都是相同的,只要能用就好。而数理统计,则是要同时结合Q quant和P quant(具体请参照数说工作室,具体名字我忘了,一个微信号)。区别在于一个强调随机概率,一个强调根据历史数据的统计。所以,基本理论要知道,比如如何判别模型显著,如何优化模型。基本模型也要会,回归,Clustering, sequence analysis等等。只有精通这些模型,才能知道怎么从统计角度去解决商业文体。analytic里面经常有个说法:
report 告诉你过去发生什么
BI告诉你现在发生什么
modeling 告诉你将来发生什么
其中的意义可以好好体会一下。
再到数据库查询,那基本SAS,SQL,python的指令要会,这些花不了太多时间去学,但是用得好就很关键。俗话说80%的时间data cleansing, 20%作模型。大家体会下。因为CS出身,所以编程好些,处理数据确实帮我省了不少时间。
这里再强调一个mind set很重要:作模型,是要在结论,结果符合商业逻辑的前提下进行诠释。我看到很多刚毕业的stats的人,很喜欢用复杂的stats变量用在模型,结果当然模型很fit,但是却很难解释。这一点一直都很有争议,不是因为用了不好,而是用的话你要知道用这个变量的好与坏是什么。比如很多人喜欢用interaction变量放在回归模型,2维,3维,请自行体会下。
最后,底层数据存储技术。这块我涉足不深,不敢乱说。但基本体会是,有个高效的,高容错,高吞吐量,兼容性强的数据库是做数据分析的基础。
恩,差不多到这。至于先学什么后学什么可以自己根据实际需求安排下。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Excel数据分析中,数据透视表是汇总、整理海量数据的高效工具,而公式则是实现数据二次计算、逻辑判断的核心功能。实际操作中 ...
2026-04-30Excel透视图是数据分析中不可或缺的工具,它能将透视表中的数据快速可视化,帮助我们直观捕捉数据规律、呈现分析结果。但在实际 ...
2026-04-30 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-04-30在中介效应分析中,人口统计学变量(如年龄、性别、学历、收入、职业等)是常见的控制变量或调节变量,其处理方式直接影响分析结 ...
2026-04-29在SQL数据库实操中,日期数据的存储与显示是高频需求,而“数字日期”(如20240520、20241231、45321)是很多开发者、数据分析师 ...
2026-04-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-04-29在手游行业竞争日趋白热化的当下,“流量为王”早已升级为“留存为王”,而付费用户留存率更是衡量一款手游盈利能力、运营质量的 ...
2026-04-28在日常MySQL数据库运维与开发中,经常会遇到“同一台服务器上,两个不同数据库(以下简称“源库”“目标库”)的表数据需要保持 ...
2026-04-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-04-28箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27 很多数据分析师精通Excel函数和数据透视表,但当被问到“数据从哪里来”“表和视图有什么区别”“数据库管理系统和SQL是什么 ...
2026-04-27在大数据技术飞速迭代、数字营销竞争日趋激烈的今天,“精准触达、高效转化、成本可控”已成为企业营销的核心诉求。传统广告投放 ...
2026-04-24在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22