
数据分析中常用的数据模型
一、抽样分析模型
建模方法
首先确定统计的时间段,暂定为15天;从数据库中随机抽取若干名用户作为分析样本建立分析模型,模型图中假定抽样人数为100人,15天内最高使用量为200最少为15,在横坐标轴依次画出每人的使用量立柱图;然后向右侧画出最高点和最低点的水平引线;然后垂直划线连接水平线,得到上下交点之间的线段,分别在线段的中点和三分点处水平画出“中分线”“上分线”“下分线”。
分析方法
根据立柱图的分布比率确定哪条线为“多”“少”的分割线;
高柱和低柱比较均衡,则以中分线为分割线;
普遍偏高,少量低柱,则以上分线为分割线;
普遍偏低,少量高柱,则以下分线为分割线;
优点:统计建模方便快捷;
缺点:不能获得准确的宏观数据,仅获得近似的参考数据。
二、数据区间对比分析模型
建模方法
假定统计时间段为15天,抽取10000人,分别统计他们的使用量,假定最多使用量为200,最少使用量为0;模型的横坐标为使用量,纵坐标为发送人数;在横坐标上,以10条为量级,从少到多依次画出不同数量区间的发送人数立柱图,连接主图顶部重点,得到人数波动曲线。
分析方法
波动曲线的顶点和与顶点最近的最低点,即为使用量“多”和“少”的分水岭,连接两点,取中点画垂直线,即得到二分法的临界线,左侧为非活跃用户,右侧为活跃用户。如图示
根据柱状图在不同量级的分布状况,也可以采用多分法细分用户类型,如图示。
三、对比分析模型曲线类型分析
利用“数量区间对比模型”分析,不仅能得到分类用户量级标准、人数、和使用量数据,通过分析使用量曲线类型,可以得到产品和运营的宏观印象。以下对四种典型的曲线类型进行分析。
常见状态(产品研发和市场发展的初期)
有基本稳定的用户群
缺少优质用户,拔高乏力
缺少高粘度产品(功能)
基本功能还行,除了基本功能,别的不爱用
维持状态(市场发展中后期)
通过若干时间的经营,产品有一定影响,同时拥有少量fans
对初级用户的引导不够,致使中间用户空虚
产品本身或有某种缺陷,不为多数人接受,只有少数人突破瓶颈,习惯产品才成长成高级
理想状态(初、中、后期)
市场发展势头良好,用户上手快,越用越熟练,越用越喜欢
证明产品功能,用户教育俱佳
需加大对潜在用户的宣传力度,扩大用户数
严峻状态(初、中、后期)
市场发展形势不客观,用户浅尝辄止,流失严重
产品存在重大缺陷或基本功能设计实现欠佳,无法留住用户
宣传引导力度不够
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Python HTTP 请求工具对比:urllib.request 与 requests 的核心差异与选择指南 在 Python 处理 HTTP 请求(如接口调用、数据爬取 ...
2025-09-12解决 pd.read_csv 读取长浮点数据的科学计数法问题 为帮助 Python 数据从业者解决pd.read_csv读取长浮点数据时的科学计数法问题 ...
2025-09-12CDA 数据分析师:业务数据分析步骤的落地者与价值优化者 业务数据分析是企业解决日常运营问题、提升执行效率的核心手段,其价值 ...
2025-09-12用 SQL 验证业务逻辑:从规则拆解到数据把关的实战指南 在业务系统落地过程中,“业务逻辑” 是连接 “需求设计” 与 “用户体验 ...
2025-09-11塔吉特百货孕妇营销案例:数据驱动下的精准零售革命与启示 在零售行业 “流量红利见顶” 的当下,精准营销成为企业突围的核心方 ...
2025-09-11CDA 数据分析师与战略 / 业务数据分析:概念辨析与协同价值 在数据驱动决策的体系中,“战略数据分析”“业务数据分析” 是企业 ...
2025-09-11Excel 数据聚类分析:从操作实践到业务价值挖掘 在数据分析场景中,聚类分析作为 “无监督分组” 的核心工具,能从杂乱数据中挖 ...
2025-09-10统计模型的核心目的:从数据解读到决策支撑的价值导向 统计模型作为数据分析的核心工具,并非简单的 “公式堆砌”,而是围绕特定 ...
2025-09-10CDA 数据分析师:商业数据分析实践的落地者与价值创造者 商业数据分析的价值,最终要在 “实践” 中体现 —— 脱离业务场景的分 ...
2025-09-10机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04