
除了数据分析师,你还要扮演这些角色
作为统计系的学生,读书时就常常参加各种数学建模竞赛,也参与过一些市场调研和咨询的项目。在这个过程中,让我印象最深的不是数据处理和分析,反而是与人沟通的过程。
研一时,我与同学组成的团队参与了一个旅游策划公司的项目。我们作为乙方为甲方提供数据咨询。我们自己做数据收集、设计调查问卷。这是一个很复杂的过程,既要保证访问者的认可性,由于成本原因群体也不能太大。根据统计数据,我们给出一个旅游者的行为画像,根据出行的时间、频率、花费、交通工具等变量,采用聚类分析的方法,对用户进行细分,看他们分别适合什么样的产品。
我们调查的范围是重庆主城区,采样涵盖到不同景点、不同年龄段的人群。在做调查之前,我们去跑各个景区,跟游客聊天,对旅客的情况有一个“摸底”。我们去跟游客接触,去问问题,沟通这个环节至关重要。
工作之后,我越发觉得,身为分析师要具备一定的“公关”技能。
毕业之后我去了一家第三方支付公司。消费者刷卡时的个人信息存在一定安全隐患,我负责做线下的伪卡防范工作,就是从历史的安全隐患数据中发现问题,总结特征,建立危险识别模型,最终当交易发生的时候,通过概率值判断是不是盗刷。
风险控制是公司业务的支撑部门。公司的互联网业务会带来很多用户,支付是其中必不可少的一个环节,也是互联网金融的基础。
然而这是一个新行业,这意味着你没有扩样本。从几率学角度来讲,凡是有监督的模型,比如输入1到20个变量,输出只是一个变量,它只告诉你是或否,但拒绝还是不拒绝要自己判断。所以我需要去训练,训练是来自于历史数据的积累,没有历史数据就带来很大的困难,只能尝试建立半监督模型,在没有数据的情况下养数据。
我们提倡数据多维度、多样性,但你的数据权限可能是有限的,资源是有限的。在这个过程中你就需要接入其它部门的数据。你如何说服对方为你提供数据,这需要一定的沟通技巧和巧妙的专业呈现,让跨部门的同事信任你。
这个工作不能着急,要持续不断地沟通交流,时不时把你正在做的事情给对方看,让他了解你工作的内容,看到你的努力。
举个例子,在进行风险控制时,不可避免地会把用户体验降低。比如你在网上购买理财产品,注册一个账户,对密码的复杂度要求不够严谨,用户可能会觉得注册过程很方便流畅,但会带来风险。反之,比如12306以前出现过信息泄露的问题,它现在的验证码就变成图片验证,但过于麻烦,用户体验就不好。
产品部门的同事会考虑风险控制会降低用户体验,让用户流失。但如果后期出现了安全问题,你做的东西帮助他规避了风险,他就会理解你的工作,愿意用你的东西,所以你做的东西一定要有价值。对于这个问题,我们有时也会进行灰度测试,比较A版本和B版本在转化率上有什么差异,不断调整,在风险控制和用户体验之间找到一个平衡点。
销售
根据支持的工作,帮助他们的区域市场分析哪个项目是可以做的,该往哪个方向发展。我可以参与他们的销售会议,协助制定销售目标。在这个过程当中,我可以学到销售部门的人员是怎么考虑问题的。
后来又去了平安保险实习。当时去了平安产险管理部,我主要负责车商渠道的数据管理。比如,我想把一个保险卖出去,我们与车辆售后网点以资源换资源的方式合作。例如客户的车出现问题之后,他首先联系保险公司,保险公司再给客户推送网点。在推送的过程中,A店、B店怎么分配资源、具体的成本多少,需要建立一个模型,把推送方案最优化。建立模型时,你就需要有销售人员的思维。
杂家
想做数据分析师的同学学科背景不同,学计算机的编程很厉害,数学的更擅长纯理的东西。以我的经验来说,企业里许多岗位偏好学统计的。
如果做数据挖掘,偏理论性,可能喜欢用数学专业的学生;在企业里,经营管理、经营分析、风险管理等相关岗位更喜欢用学统计的;大数据中心涉及到数据产品的开发,更偏向于学计算机和数学的,但这都要求有一定的统计学思维。比如我看到一个数字的时候,我要联想它背后代表什么意义,看到A问题的时候不孤立地去看,善于与总体情况联系对比,既要看到总体也要看到差异。即便不是学统计出身,也要在平时的学习工作中训练自己。
互联网金融行业对人才的需求很大。我们招聘人才,一是要看你对金融产品的理解,二要看是否具有数据思维,具有一定的数据分析技能。还有一点很重要,要有热情,这个工作要重复很多事情,但不是机械的重复,也要进行思考,这都需要热情的支撑。
我建议同学们除了要打好基本功、熟练掌握1至2门编程语言之外,还要多接触数据,培养对数据的感觉;同时多研究不同的商业模式,研究不同的公司是怎么赢利的,天文地理历史人文,知识面要广博多样,让自己变成一个杂家,这可能会让你的数据分析工作更有想象力。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28