京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS分析技术:多因素方差分析
下面介绍多因素方差分析。单因素方差分析和多因素方差分析都是针对一个因变量的方差分析方法,单因素方差分析是通过分析单个因素(自变量)的不同水平对应因变量的数据变化来判断该因素是否对因变量有影响;多因素方差分析则包含两个以上的因素(自变量),不仅需要考虑每个因素单独对因变量的影响,还需要考虑因素之间交互作用以后对因变量的影响。下面两个表格是单因素方差分析和两因素方差分析的数据整理表格。
多因素方差分析原理
我们以两因素方差分析为例,介绍多因素方差分析原理。 假设因变量可能受两个因素(自变量)A和B的影响,其中因素A有p个水平,因素B有q个水平,则两个因素的交叉将因变量数据分成了P×Q个水平,如下图所示。
分析A和B两个因素对于因变量的影响,仍然是从因变量的样本方差开始,样本的总方差SST可以分解为:
SSA代表因素A引起的因变量数据变化的方差;SSB代表因素B引起的方差;SSAB表示因素A和因素B交互作用引起的方差;SSE代表随机误差。假如因素A的水平发生变化,比如从水平1变化到水平2,无论因素B取那个水平,因变量观测值都要同时增加或同时减小,则表示因素A的变化就可以决定观测值的变化,此时称A和B没有交互作用;如果因素A从水平1变化到水平2,因变量观测值在B的不同水平上变化方向不同,在有些水平上增加,有些水平上减小,也就是需要A和B交叉的水平才能确定因变量的变化,此时称因素A和B存在交互作用。
分析步骤
1、提出成对假设;原假设是多因素方差分析原假设为各因素的各个水平下,因变量的均值没有显著性差异;备择假设是各因素的各个水平下,因变量的均值不完全相同。
2、构造F统计量;构造3个不同的F统计量:
3、计算F值及p值,做出判断;SPSS会自动计算各统计量观测值和对应的概率p值,并以表格方式输出。根据P值,进行统计检验。如果P值大于显著水平,则不能拒绝原假设,认为因素水平上没有显著差异;如果P值小于显著水平,则拒绝原假设,认为有显著差异。
案例分析
2016年的考研人数创造了历史新高,其中一个重要原因是人们普遍认为学历与薪资收入成正比。现有一份社会调查数据,采集了470名公司员工的学历、工资和工作年限等7项信息。用多因素方差分析方法分析性别和学历对他们的薪资是否有显著影响。
(例题数据文件已经上传到QQ群中,需要的朋友可以前往下载)
分析步骤
1、选择【分析】-【一般线性模型】-【单变量】,如下图所示,在跳出对话框中将工资选入因变量框,将学历和性别选入固定因子框。
2、概要图设置;点击绘图按钮,将学历选为水平轴,性别选入单图,点击添加。
3、点击【选项】按钮,按下图所示操作,其它保持系统默认设置,点击输出结果。
结果分析
1、主体间因子列表。
主体因子列表显示共有教育年限和性别两个因子,分别包含三个水平和两个水平,数字表示因子各水平对应的样本个案数。
2、方差齐性检验结果;
方差齐性检验结果显著性p等于0.000,小于0.05,说明方差齐性检验未通过,因此事后多重比较表也不具参考价值。
3、主体间效应检验表
修正的模型对应的p值为0.000,小于0.05,达到显著水平,说明学历和性别两个因素中至少有一个对当前工资的影响是显著的;学历的主效应F值为.226.372,P=0.000,达到非常显著的水平,说明学历对当前工资影响很大;性别对应的p值为0.022,小于0.05,说明性别对当前工资的影响也是显著的;学历*性别的交互效应p值为0.111,大于显著水平0.05,说明学历和性别交互作用后对当前工资的影响不显著。
4、概要图
由图可知,当前工资的均值在男女性别的两个水平上都随着教育年限的增加呈上升趋势。两条线有交叉,说明教育年限和性别有交互效应,但是从主体间效应检验表可知,交互效应没有达到显著性程度。
综合结论:数据分析结果显示学历对工资收入有显著性影响,这也证明考研人数屡创新高有其合理性存在。性别对收入也有显著影响,只是影响程度不及学历因素,说明社会发展到现在,职场对女性的歧视正在逐步降低,但是并未完全消失,仍需社会各方的努力。性别与学历交互后对工资收入没有显著影响,说明两者之间不存在明显的交互作用。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09金融数据分析的核心价值,是通过挖掘数据规律、识别风险、捕捉机会,为投资决策、风险控制、业务优化提供精准支撑——而这一切的 ...
2026-03-09在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心工作,是通过数据解读业务、支撑决策,而指标与指标体系 ...
2026-03-09在数据处理的全流程中,数据呈现与数据分析是两个紧密关联却截然不同的核心环节。无论是科研数据整理、企业业务复盘,还是日常数 ...
2026-03-06在数据分析、数据预处理场景中,dat文件是一种常见的二进制或文本格式数据文件,广泛应用于科研数据、工程数据、传感器数据等领 ...
2026-03-06在数据驱动决策的时代,CDA(Certified Data Analyst)数据分析师的核心价值,早已超越单纯的数据清洗与统计分析,而是通过数据 ...
2026-03-06在教学管理、培训数据统计、课程体系搭建等场景中,经常需要对课时数据进行排序并实现累加计算——比如,按课程章节排序,累加各 ...
2026-03-05在数据分析场景中,环比是衡量数据短期波动的核心指标——它通过对比“当前周期与上一个相邻周期”的数据,直观反映指标的月度、 ...
2026-03-05数据治理是数字化时代企业实现数据价值最大化的核心前提,而CDA(Certified Data Analyst)数据分析师作为数据全生命周期的核心 ...
2026-03-05在实验检测、质量控制、科研验证等场景中,“方法验证”是确保检测/分析结果可靠、可复用的核心环节——无论是新开发的检测方法 ...
2026-03-04在数据分析、科研实验、办公统计等场景中,我们常常需要对比两组数据的整体差异——比如两种营销策略的销售额差异、两种实验方案 ...
2026-03-04在数字化转型进入深水区的今天,企业对数据的依赖程度日益加深,而数据治理体系则是企业实现数据规范化、高质量化、价值化的核心 ...
2026-03-04在深度学习,尤其是卷积神经网络(CNN)的实操中,转置卷积(Transposed Convolution)是一个高频应用的操作——它核心用于实现 ...
2026-03-03在日常办公、数据分析、金融理财、科研统计等场景中,我们经常需要计算“平均值”来概括一组数据的整体水平——比如计算月度平均 ...
2026-03-03