京公网安备 11010802034615号
经营许可证编号:京B2-20210330
年薪50万的大数据分析师养成记
以下是一位在数据分析领域打滚了N年后的分析师写下的一些总结和体会大家可以借鉴学习!
一、成为数据分析师有哪些要求?
1、理论知识要宽泛,涉及数学、市场和技术。要求及对数据敏感,包括统计知识、市场研究、模型原理等。
2、常规分析工具的使用,包括数据库、数据挖掘、统计分析工具,常用办公软件(Excel、PPT、思维导图)等等。
3、有一定的业务理解能力,能理解业务背后的商业逻辑。因为只有理解了商业问题,才能转换成数据分析的问题,从而满足部门的要求。
4、数据报告和数据可视化的能力。数据分析得再好,如果不能以漂亮的方式“表达”,成效也会大打折扣。
二、把数据分析当做一种能力来培养
现在大多工作都需要你拥有逻辑分析能力,尤其是对数据的分析理解。在数据化运营理念深入的今天,BAT这样的大型互联网公司强调全员参与数据化运营,把数据分析当作一种能力在培训,也必定是未来趋势。
三、数据分析师所需具备的能力和知识(从数据分析的4个步骤来理解)
数据分析的四个步骤:数据获取、数据处理、数据分析、数据呈现。
1、数据获取
数据获取看似简单,但是需要把握对问题的商业理解,转化成数据问题来解决,直白点讲就是需要哪些数据,从哪些角度来分析,界定问题后,再进行数据采集。此环节,需要数据分析师具备结构化的逻辑思维。
推荐书籍:《金字塔原理》、麦肯锡三部曲:麦肯锡意识、工具、方法;
推荐工具:思维导图工具(Xmind\百度脑图等);
2、数据处理
数据的处理需要掌握有效率的工具:
Excel及高端技能:日常工作通用,容易掌握,处理10万级别的数据很轻松。
学习高端Excel需要哪些技能?
学习excel是个循序渐进的过程
基础:简单的表格数据处理、打印、查询、筛选、排序
函数和公式:常用函数、高级数据计算、数组公式、多维引用、function
可视化图表:图形图示展示、高级图表、图表插件
数据透视表、VBA程序开发
按照我习惯的方法,先过一遍基础,知道什么是什么,然后找几个case练习。多逛逛excelhome论坛,平常多思考如何用excel来解决问题,善用插件,还有记得保存。
Oracle和SQL sever:企业最常用的千万级别的数据库,熟练掌握SQL语言。
保持不断的技术学习,比如学习新流行的hadoop之类的分布式数据库来提升个人能力,对求职有帮助。
3、分析数据
分析数据往往需要各类统计分析模型,如关联规则、聚类、分类、预测模型等等。
因此,熟练掌握一些统计分析工具不可免:
SPSS系列:老牌的统计分析软件,SPSS Statistics(偏统计功能、市场研究)、SPSS Modeler(偏数据挖掘),不用编程,易学。
SAS:经典挖掘软件,需要编程。
R:开源软件,新流行,对非结构化数据处理效率上更高,需编程。
各类BI工具:
Tableau:可视化工具的鼻祖,对于处理好的数据可作自由的可视化分析,图表效果惊人
大数据BI工具FineBI:类同Tableau,可在前端做任意维度分析;数据可在前端继续处理(计算、筛选过滤等),可对接hadoop之类的大数据平台,数据处理性能较好。
推荐书籍:
1、《说菜鸟不会数据分析》系列,入门级书,初学者最适。
2、《数据挖掘与数据化运营实战,思路、方法、技巧与应用》,内容很系统很全面。
3、《市场研究定量分析方法与应用》,简明等编着,中国人民大学出版社。
4、数据可视化呈现
很多数据分析工具已经涵盖了数据可视化部分,只需要把数据结果进行有效的呈现和演讲汇报,可用word\PPT\H5等方式展现。
四、关于数据分析师的职业发展
1、数据分析师通常分两类,技术型分析师和业务型分析师,分工不同,但各有优势。
技术型分析师是在专门的挖掘团队里面从事数据挖掘和分析工作的。如果你能在这类专业团队学习成长,那是幸运的,但进入这类团队的门槛较高,需要扎实的数据挖掘知识、挖掘工具应用经验和编程能力。该类分析师更偏向技术线条,未来的职业通道可能走专家的技术路线。技术型分析师的角色包括数据工程师、挖掘工程师、数据科学家、建模工程师、数据架构师、ETL工程师等,这些称谓都或多或少代表了其工作性质。
业务型分析师是下沉到各业务团队或者运营部门的数据分析师,成为业务团队的一员。他们工作是支撑业务运营,包括日常业务的异常监控、客户和市场研究、参与产品开发、建立数据模型提升运营效率等。该类型分析师偏向产品和运营,可以转向做运营和产品。
2、数据分析师的理想行业在互联网,但条条大道通罗马,走合适你的路线。
从行业的角度来看:
1)互联网行业是数据分析应用最广的行业,其中的电商企业,更是目前最火的,而且企业也更重视数据分析的价值,是数据分析师理想的成长平台。
2)其次是咨询公司(比如专门的数据挖掘公司Teradata、尼尔森等市场研究公司),他们需要数据分析人才,而且相对来说,数据分析师在咨询公司成长的速度更快,专业也会更全面。
3)再次是金融行业,比如银行和证券等行业,该行业对数据分析的依赖需求,越来越大。
4)最后是电信行业(中国移动、联通和电信),它们拥有海量的数据,在严峻的竞争下,也越来越重视数据分析,但进入这些公司的门槛比较高。
五、什么人适合学习数据分析?
这个问题之前有详细写过一篇文章哪些人能做好数据分析?就好比学功夫一样,既要有天赋也要有后天的努力,但我想后者占大部分,铁杵也能磨成针。
六、如何系统地学习数据分析?
学习方法千万种,关键是找到适合自己的,最好能够结合你的工作遇到的问题来学习。
这里我列举一个经典的从0到1的入门方法
第一周:Excel学习掌握
第二周:数据可视化
第三周:分析思维的训练
第四周:数据库学习
第五周:统计知识学习
第六周:业务学习
第七周:Python/R学习
七、最后
请再次问问自己,是否真的喜欢数据分析,能否忍受处理数据时的寂寞?如果是,那就宜早不宜迟,马上开始行动吧。
再次强调:
1、把数据分析作为一种能力培养,让自己在现在的团队中展现出良好的数据分析能力,为你以后内部转岗做好准备。如果内部转岗不成,你可以考虑跳槽到我之前分析的行业中,但我强烈建议你还是需要把系统开发的编程能力学习好,并且对商业智能系统(BI和CRM)有一定了解,这也许是应聘数据分析的优势。如果没有数据分析经验去应聘,相对会难一些,用人单位会考你统计和数据挖掘模型方面的知识,以及工具使用情况。
2、扎实学好一、两门数据挖掘软件,基于你已有得编程基础,可以学SAS或者R,基本能够满足很大部分企业的需求。
3、多看多想多观察,学习业务职能是这样,细水长流,还需要不断工作积累和广泛的阅读。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在 “神经网络与卡尔曼滤波融合” 的理论基础上,Python 凭借其丰富的科学计算库(NumPy、FilterPy)、深度学习框架(PyTorch、T ...
2025-10-23在工业控制、自动驾驶、机器人导航、气象预测等领域,“状态估计” 是核心任务 —— 即从含噪声的观测数据中,精准推断系统的真 ...
2025-10-23在数据分析全流程中,“数据清洗” 恰似烹饪前的食材处理:若食材(数据)腐烂变质、混杂异物(脏数据),即便拥有精湛的烹饪技 ...
2025-10-23在人工智能领域,“大模型” 已成为近年来的热点标签:从参数超 1750 亿的 GPT-3,到万亿级参数的 PaLM,再到多模态大模型 GPT-4 ...
2025-10-22在 MySQL 数据库的日常运维与开发中,“更新数据是否会影响读数据” 是一个高频疑问。这个问题的答案并非简单的 “是” 或 “否 ...
2025-10-22在企业数据分析中,“数据孤岛” 是制约分析深度的核心瓶颈 —— 用户数据散落在注册系统、APP 日志、客服记录中,订单数据分散 ...
2025-10-22在神经网络设计中,“隐藏层个数” 是决定模型能力的关键参数 —— 太少会导致 “欠拟合”(模型无法捕捉复杂数据规律,如用单隐 ...
2025-10-21在特征工程流程中,“单变量筛选” 是承上启下的关键步骤 —— 它通过分析单个特征与目标变量的关联强度,剔除无意义、冗余的特 ...
2025-10-21在数据分析全流程中,“数据读取” 常被误解为 “简单的文件打开”—— 双击 Excel、执行基础 SQL 查询即可完成。但对 CDA(Cert ...
2025-10-21在实际业务数据分析中,我们遇到的大多数数据并非理想的正态分布 —— 电商平台的用户消费金额(少数用户单次消费上万元,多数集 ...
2025-10-20在数字化交互中,用户的每一次操作 —— 从电商平台的 “浏览商品→加入购物车→查看评价→放弃下单”,到内容 APP 的 “点击短 ...
2025-10-20在数据分析的全流程中,“数据采集” 是最基础也最关键的环节 —— 如同烹饪前需备好新鲜食材,若采集的数据不完整、不准确或不 ...
2025-10-20在数据成为新时代“石油”的今天,几乎每个职场人都在焦虑: “为什么别人能用数据驱动决策、升职加薪,而我面对Excel表格却无从 ...
2025-10-18数据清洗是 “数据价值挖掘的前置关卡”—— 其核心目标是 “去除噪声、修正错误、规范格式”,但前提是不破坏数据的真实业务含 ...
2025-10-17在数据汇总分析中,透视表凭借灵活的字段重组能力成为核心工具,但原始透视表仅能呈现数值结果,缺乏对数据背景、异常原因或业务 ...
2025-10-17在企业管理中,“凭经验定策略” 的传统模式正逐渐失效 —— 金融机构靠 “研究员主观判断” 选股可能错失收益,电商靠 “运营拍 ...
2025-10-17在数据库日常操作中,INSERT INTO SELECT是实现 “批量数据迁移” 的核心 SQL 语句 —— 它能直接将一个表(或查询结果集)的数 ...
2025-10-16在机器学习建模中,“参数” 是决定模型效果的关键变量 —— 无论是线性回归的系数、随机森林的树深度,还是神经网络的权重,这 ...
2025-10-16在数字化浪潮中,“数据” 已从 “辅助决策的工具” 升级为 “驱动业务的核心资产”—— 电商平台靠用户行为数据优化推荐算法, ...
2025-10-16在大模型从实验室走向生产环境的过程中,“稳定性” 是决定其能否实用的关键 —— 一个在单轮测试中表现优异的模型,若在高并发 ...
2025-10-15