
SPSS—方差分析(Analysis of Variance, ANOVA)—多因素方差分析(无重复试验双因素)
当遇到两个因素同时影响结果的情况,需要检验是一个因素起作用,还是两个因素都起作用,或者两个因素的影响都不显著
场景
某公司某种茶饮料的调查分析数据
统计了该茶饮料两种不同的包装(新设计的包装和旧的包装)在三个随机的地点的销售金额,分析销售地点和包装方式对销售金额各有怎样的影响
数学模型
无重复试验双因素的方差分析数学模型
试验区组
假设前提
构建模型
偏差平方和及其分解
检验F统计量
方差分析表
菜单
数据源
grocery_1month.sav
1
2
单变量选择
因变量
要进行分析的目标变量,一般为度量变量,数值为数值型。只能选择一个唯一变量。
固定因子
用来分组,一般是可以人为控制的
随机因子
用来分组,各个水平一般是不可以认为控制的,如体重,身高等
协变量
用于协方差分析
与因变量相关的定量变量,是用来控制其他与因子变量有关且影响方差分析的目标变量的其他干扰因素,类似回归分析中的控制变量
WLS权重
选择加权最小二乘法的权重系数
如果加权变量为0、负数或缺失,则将该个案从分析中排除。已用在模型中的变量不能用于加权变量
模型
全因子
系统默认项,用于建立全模型,分析所有因素的主效应及其交互效应,包括所有因子主效应、所有协变量主效应、所有因子间交互,但不包含协变量交互
设定
表示可以仅指定其中一部分的交互或指定因子协变量交互,必须指定要包含在模型中的所有项
因子与协变量
列出在Univariate过程中选择的所有的固定因素变量(F)、随机因素变量(R)和协变量(C)
构建项
交互: 定义进行选择变量的交互效应的方差分析
主效应:
定义进行选择变量的主效应的方差分析
表示模型中仅考虑各个控制变量的主效应而不考虑变量之间的-交互项
All 2-way - All 5-way:
定义进行所有变量的i阶交互效应的方差分析
模型
选择方差分析的主效应。若同时将因子与协变量选项中的两个变量选入,则将其交互效应强行纳入模型
平方和
定义平方和的分解方法
I 分层平凡和,仅处理主效应
II 处理所有其他效应
III 处理I和II中的所有效应
IV 要考虑所有的二维、三维、四纬的交互效应
在模型中包含截距
如果认为数据回归线可以经过坐标轴原点的话,就可以在模型中不含有截距,但是一般系统默认含有截距项
对比
用于设置比较因素水平间差异的方法
无
不进行因子各水平间的任何比较
因子变量每个水平与总平均值进行对比
简单
对因子变量各个水平与第一个水平和最后一个水平的均值进行对比
差值
表示对因子变量的各个水平都与前一个水平进行做差比较
Helmert
表示对因子变量的各个水平都与后面的水平进行做差比较,当然最后一个水平除外
重复
多项式
对每个水平按因子顺序进行趋势分析
绘制
水平轴
均数轮廓图中的横坐标
单图
用来绘制分离线的
多图
每个水平可用来创建分离图
两两比较
参考单因素方差分析,用于确定哪些均值存在差异
保存
预测值
用于保存模型为每个个案预测的值
未标准化
模型为因变量预测的值
加权
加权未标准化预测值
仅在已经选择了WLS变量的情况下可用
标准误
对于自变量具有相同值的个案所对应的因变量均值标准差的估计
残差
用于保存模型的残差
未标准化
因变量的实际值减去由模型预测的值
加权
在选择了WLS变量时提供加权的未标准化残差
标准化
对残差进行标准化的值
学生化
Student化的残差
删除
表示删除残差
诊断
用于标识自变量的值具有不寻常组合的个案和可能对模型产生很大影响的个案的测量
Cook距离
在特定个案从回归系数的计算中排除的情况下,所有个案的残差变化幅度的测量,较大的Cook距离表名从回归统计量的计算中排除个案后,系统会发生根本变化
杠杆值
未居中的杠杆值,每个观察值对模型拟合的相对影响
系数统计
用于保存模型中的参数估计值的斜方差矩阵
选项
提供一些基于固定效应模型的统计量
显示均值
输出该变量的估算边际均值、标准误等统计量
比较主效应
为模型中的任何主效应提供估计边际均值未修正的成对比较
输出
显著性水平
结果分析
描述性统计量
方差齐性检验
检验的零假设:所有组中因变量的误差方差均相等
可以认为因变量在各个因素水平下的误差方差相等
主体间效应的检验
整体模型的Sig < 0.05,此方差模型是显著的
R方 = 0.138,说明消费额的变异被“gender”,“style”,“gender*style”解释的部分有13.8%
gender(性别)对消费额有显著影响
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29