京公网安备 11010802034615号
经营许可证编号:京B2-20210330
SPSS分析技术:多因素方差分析
下面介绍多因素方差分析。单因素方差分析和多因素方差分析都是针对一个因变量的方差分析方法,单因素方差分析是通过分析单个因素(自变量)的不同水平对应因变量的数据变化来判断该因素是否对因变量有影响;多因素方差分析则包含两个以上的因素(自变量),不仅需要考虑每个因素单独对因变量的影响,还需要考虑因素之间交互作用以后对因变量的影响。下面两个表格是单因素方差分析和两因素方差分析的数据整理表格。
多因素方差分析原理
我们以两因素方差分析为例,介绍多因素方差分析原理。 假设因变量可能受两个因素(自变量)A和B的影响,其中因素A有p个水平,因素B有q个水平,则两个因素的交叉将因变量数据分成了P×Q个水平,如下图所示。
分析A和B两个因素对于因变量的影响,仍然是从因变量的样本方差开始,样本的总方差SST可以分解为:
SSA代表因素A引起的因变量数据变化的方差;SSB代表因素B引起的方差;SSAB表示因素A和因素B交互作用引起的方差;SSE代表随机误差。假如因素A的水平发生变化,比如从水平1变化到水平2,无论因素B取那个水平,因变量观测值都要同时增加或同时减小,则表示因素A的变化就可以决定观测值的变化,此时称A和B没有交互作用;如果因素A从水平1变化到水平2,因变量观测值在B的不同水平上变化方向不同,在有些水平上增加,有些水平上减小,也就是需要A和B交叉的水平才能确定因变量的变化,此时称因素A和B存在交互作用。
分析步骤
1、提出成对假设;原假设是多因素方差分析原假设为各因素的各个水平下,因变量的均值没有显著性差异;备择假设是各因素的各个水平下,因变量的均值不完全相同。
2、构造F统计量;构造3个不同的F统计量:
3、计算F值及p值,做出判断;SPSS会自动计算各统计量观测值和对应的概率p值,并以表格方式输出。根据P值,进行统计检验。如果P值大于显著水平,则不能拒绝原假设,认为因素水平上没有显著差异;如果P值小于显著水平,则拒绝原假设,认为有显著差异。
案例分析
2016年的考研人数创造了历史新高,其中一个重要原因是人们普遍认为学历与薪资收入成正比。现有一份社会调查数据,采集了470名公司员工的学历、工资和工作年限等7项信息。用多因素方差分析方法分析性别和学历对他们的薪资是否有显著影响。
(例题数据文件已经上传到QQ群中,需要的朋友可以前往下载)
分析步骤
1、选择【分析】-【一般线性模型】-【单变量】,如下图所示,在跳出对话框中将工资选入因变量框,将学历和性别选入固定因子框。
2、概要图设置;点击绘图按钮,将学历选为水平轴,性别选入单图,点击添加。
3、点击【选项】按钮,按下图所示操作,其它保持系统默认设置,点击输出结果。
结果分析
1、主体间因子列表。
主体因子列表显示共有教育年限和性别两个因子,分别包含三个水平和两个水平,数字表示因子各水平对应的样本个案数。
2、方差齐性检验结果;
方差齐性检验结果显著性p等于0.000,小于0.05,说明方差齐性检验未通过,因此事后多重比较表也不具参考价值。
3、主体间效应检验表
修正的模型对应的p值为0.000,小于0.05,达到显著水平,说明学历和性别两个因素中至少有一个对当前工资的影响是显著的;学历的主效应F值为.226.372,P=0.000,达到非常显著的水平,说明学历对当前工资影响很大;性别对应的p值为0.022,小于0.05,说明性别对当前工资的影响也是显著的;学历*性别的交互效应p值为0.111,大于显著水平0.05,说明学历和性别交互作用后对当前工资的影响不显著。
4、概要图
由图可知,当前工资的均值在男女性别的两个水平上都随着教育年限的增加呈上升趋势。两条线有交叉,说明教育年限和性别有交互效应,但是从主体间效应检验表可知,交互效应没有达到显著性程度。
综合结论:数据分析结果显示学历对工资收入有显著性影响,这也证明考研人数屡创新高有其合理性存在。性别对收入也有显著影响,只是影响程度不及学历因素,说明社会发展到现在,职场对女性的歧视正在逐步降低,但是并未完全消失,仍需社会各方的努力。性别与学历交互后对工资收入没有显著影响,说明两者之间不存在明显的交互作用。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在MySQL数据库日常查询、数据统计、后台接口开发、数据导出等场景中,开发者经常需要查询数据表除某几列之外的所有字段。例如查 ...
2026-06-09在Python网络请求、爬虫开发、接口测试、数据抓取等实操场景中,requests库是最常用的第三方请求工具,而content属性是requests ...
2026-06-09 数据分析正在重塑每一个行业。CDA认证的三本官方教材,分别对应Level I、Level II、Level III,为你铺就从业务数据分析到数 ...
2026-06-09在数字财务、智慧财税、业财融合深度推进的当下,传统财务模式下数据标准混乱、业务流程碎片化、知识无法沉淀、系统互通性差等问 ...
2026-06-08随着数字经济深度渗透各行各业,数据正式成为继土地、劳动力、资本、技术之后的第五大生产要素,是企业数字化转型、精细化运营、 ...
2026-06-08 很多数据分析师能熟练写SQL、做透视表,但当被问到“数据是从哪里来的?经过哪些加工才进入数据仓库?ETL具体做了什么?”时 ...
2026-06-08【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-06-04在问卷调查与社会科学数据分析中,卡方检验是最常用、最基础的非参数检验方法,广泛应用于市场调研、用户分析、行为统计、满意度 ...
2026-06-03【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-03 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-06-03逻辑回归是数据分析、机器学习、统计建模中应用最广泛的二分类预测模型,常用于风险判断、行为预测、归因分析等场景。在SPSS、Py ...
2026-06-02数字经济时代,市场竞争日趋同质化,用户消费需求愈发个性化、多元化,传统依托经验、粗放式、广撒网的营销模式弊端日益凸显。长 ...
2026-06-02 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-06-02在市场竞争日趋饱和、用户需求不断细分的当下,企业创业创新、产品迭代与市场拓展不再依赖经验决策,而是需要系统化、工具化的商 ...
2026-06-01【核心关键词】调度、岗位、数据库、企业、报表、培训、程序、数据分析、数据加工、业务部门、企业数据、调度工具、业务指标、 ...
2026-06-01