京公网安备 11010802034615号
经营许可证编号:京B2-20210330
在单因素方差分析ANOVA中,如果该因素影响比较显著,那么需要进一步利用多重比较方法比较该因素不同水平的影响,确定不同水平下该因素的影响是否显著。常见的多重比较方法主要有两种,LSD法和Tukey HSD法。下面对R语言中,这两种多重比较方法的实现进行举例。
前期数据如下,影响因素为group,指标为value:
> head(tarD)
value group sample time
A0522W11NC1 0.0002053745 normal A0522W11NC1 11week
A0522W11NC2 0.0031773712 normal A0522W11NC2 11week
A0522W11NC3 0.0060378288 normal A0522W11NC3 11week
A0522W11NC4 0.0017626931 normal A0522W11NC4 11week
A0522W11NC5 0.0018035261 normal A0522W11NC5 11week
A0522W11NC6 0.0036690067 normal A0522W11NC6 11week
> tmp <- aov(value ~ group, tarD)
最小显著差数检验法(LSD法)
> res <- LSD.test(tmp, 'group', p.adj = 'bonferroni')
> print(res$groups)
trt means M
1 normal 2.576910e-03 a
2 drug3 7.552555e-04 b
3 drug2 7.269247e-05 b
4 high_fat 6.220610e-05 b
5 drug1 2.954733e-05 b
Tukey氏固定差距检验法(Tukey HSD)
> TukeyHSD(tmp)
Tukey multiple comparisons of means
95% family-wise confidence level
Fit: aov(formula = value ~ group, data = tarD)
$group
diff lwr upr p adj
drug2-drug1 4.314514e-05 -0.0015468705 0.0016331608 0.9999916
drug3-drug1 7.257082e-04 -0.0008643074 0.0023157239 0.6929965
high_fat-drug1 3.265877e-05 -0.0015149488 0.0015802664 0.9999969
normal-drug1 2.547362e-03 0.0009997549 0.0040949700 0.0002613
drug3-drug2 6.825631e-04 -0.0009487586 0.0023138847 0.7563196
high_fat-drug2 -1.048637e-05 -0.0016005020 0.0015795293 1.0000000
normal-drug2 2.504217e-03 0.0009142017 0.0040942330 0.0004945
high_fat-drug3 -6.930494e-04 -0.0022830651 0.0008969662 0.7277757
normal-drug3 1.821654e-03 0.0002316386 0.0034116699 0.0175538
normal-high_fat 2.514704e-03 0.0009670961 0.0040623113 0.0003161
> TukeyHSD(tmp)$group
diff lwr upr p adj
drug2-drug1 4.314514e-05 -0.0015468705 0.0016331608 0.9999915820
drug3-drug1 7.257082e-04 -0.0008643074 0.0023157239 0.6929965170
high_fat-drug1 3.265877e-05 -0.0015149488 0.0015802664 0.9999969171
normal-drug1 2.547362e-03 0.0009997549 0.0040949700 0.0002612744
drug3-drug2 6.825631e-04 -0.0009487586 0.0023138847 0.7563195891
high_fat-drug2 -1.048637e-05 -0.0016005020 0.0015795293 0.9999999705
normal-drug2 2.504217e-03 0.0009142017 0.0040942330 0.0004944674
high_fat-drug3 -6.930494e-04 -0.0022830651 0.0008969662 0.7277757202
normal-drug3 1.821654e-03 0.0002316386 0.0034116699 0.0175537862
normal-high_fat 2.514704e-03 0.0009670961 0.0040623113 0.0003161003
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据驱动运营的时代,指标是连接业务目标与实际行动的核心桥梁,是企业解读业务现状、发现问题、预判趋势的“量化标尺”。一套 ...
2026-05-08在存量竞争日趋激烈的商业时代,“以客户为中心”早已从口号落地为企业运营的核心逻辑。而客户画像作为打通“了解客户”与“服务 ...
2026-05-08 很多数据分析师每天与Excel打交道,但当被问到“什么是表格结构数据”“它和表结构数据有什么区别”“表格结构数据有哪些核 ...
2026-05-08在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07在数据分析、计量研究等场景中,回归分析是探究变量间量化关系的核心方法,无论是简单的一元线性回归,还是复杂的多元线性回归、 ...
2026-05-07 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-05-07在数字化时代,商业竞争的核心已从“经验驱动”转向“数据驱动”,越来越多的企业意识到,商业分析不是简单的数据统计与报表呈现 ...
2026-05-06在Excel数据透视表的实操中,“引用”是连接透视表与公式、辅助数据的核心操作,而相对引用作为最基础、最常用的引用方式,其设 ...
2026-05-06 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-05-06在Excel数据分析中,数据透视表是汇总、整理海量数据的高效工具,而公式则是实现数据二次计算、逻辑判断的核心功能。实际操作中 ...
2026-04-30Excel透视图是数据分析中不可或缺的工具,它能将透视表中的数据快速可视化,帮助我们直观捕捉数据规律、呈现分析结果。但在实际 ...
2026-04-30 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-04-30在中介效应分析中,人口统计学变量(如年龄、性别、学历、收入、职业等)是常见的控制变量或调节变量,其处理方式直接影响分析结 ...
2026-04-29在SQL数据库实操中,日期数据的存储与显示是高频需求,而“数字日期”(如20240520、20241231、45321)是很多开发者、数据分析师 ...
2026-04-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-04-29在手游行业竞争日趋白热化的当下,“流量为王”早已升级为“留存为王”,而付费用户留存率更是衡量一款手游盈利能力、运营质量的 ...
2026-04-28在日常MySQL数据库运维与开发中,经常会遇到“同一台服务器上,两个不同数据库(以下简称“源库”“目标库”)的表数据需要保持 ...
2026-04-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-04-28箱线图(Box Plot)作为一种经典的数据可视化工具,广泛应用于统计学、数据分析、科研实证等领域,核心价值在于直观呈现数据的集 ...
2026-04-27实证分析是社会科学、自然科学、经济管理等领域开展研究的核心范式,其核心逻辑是通过对多维度数据的收集、分析与解读,揭示变量 ...
2026-04-27