
卡方分布是著名的三大抽样分布之一,在各种统计检验中都有着重要的意义。小编今天就跟大家分享一下有关卡方分布的一些理论知识,希望对于大家有所帮助。
一、什么是卡方分布?
1、卡方分布来源
卡方分布是阿贝(Abbe)在1863年首次提出的,后来由海尔墨特(Hermert)以及现代统计学的奠基人之一的卡·皮尔逊(C.K. Pearson)分别在1875年和1900年推导出来,是统计学中的非常实用的一个有名的分布。
2、卡方分布定义
概率密度
设X为自由度为的卡方随机变量, 那么它的概率密度函数就是
R代码绘制:
x <- seq(0, 60, 0.005) f_nx <- function(x, n){ x^(n/2-1)*exp(-x/2)/(2^(n/2)*gamma(n/2)) } ## 当然你也可以用R自带的 dchisq()函数来计算概率密度 n <- 1 plot(x, f_nx(x, n), type='l', ylim=c(0, 0.25), ylab=expression(f[n](x))) text(3, 0.25, paste('n =', n)) n <- 4 lines(x, f_nx(x, n), type='l', col='red') text(5, 0.17, paste('n =', n) , col='red') n <- 10 lines(x, f_nx(x, n), type='l', col='blue') text(12, 0.1, paste('n =', n) , col='blue') n <- 20 lines(x, f_nx(x, n), type='l', col='purple') text(20, 0.075, paste('n =', n) , col='purple') n <- 30 lines(x, f_nx(x, n), type='l', col='green') text(30, 0.062, paste('n =', n) , col='green') n <- 40 lines(x, f_nx(x, n), type='l', col='pink') text(44, 0.05, paste('n =', n) , col='pink')
当自由度n越大,概率密度曲线越趋于对称
4、χ2 变量性质:
卡方分布拥有具有k个自由度的,是一个由k个独立标准正态随机变量的和而构成的分布通常用于卡方检验中。
二、什么是卡方检验?
1、卡方检验是一种用途很广的计数资料的假设检验方法。属于非参数检验,主要是对两个或两个以上样本率( 构成比)以及两个分类变量的关联性分析进行对比。卡方检验的根本思想就是比较理论频数和实际频数的吻合程度或者拟合优度问题。/2、卡方检验的计算公式为:
其中,A是实际值,T是理论值。
x2是用于衡量实际值与理论值的差异程度的,这也是卡方检验的核心思想,其主要包含了以下两个信息:
1. 实际值与理论值偏差的绝对大小(由于平方的存在,差异是被放大的)
2. 差异程度与理论值的相对大小
3、
对某无序分类变量各水平在两组或多组间的分布是否一致进行考察可以说是卡方检验最主要的用途了,除此之外.卡方检验还有很多其他用途。主要可以分为以下几个方面:
(1)检验某个连续变量的分布与某种理论分布是否一致。
(2)检验某个分类变量各类出现的概率与指定概率是否一致。
(3)检验某两种方法的结果是否保持一致。
(4)检验某两个分类变量是不是相互独立的。
(5)检验控制某种或者某几种分类因素的作用之后,判断两个分类变量是不是相互独立的。
推荐学习书籍
《CDA一级教材》适合CDA一级考生备考,也适合业务及数据分析岗位的从业者提升自我。完整电子版已上线CDA网校,累计已有10万+在读~
免费加入阅读:https://edu.cda.cn/goods/show/3151?targetId=5147&preview=0
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
剖析 CDA 数据分析师考试题型:解锁高效备考与答题策略 CDA(Certified Data Analyst)数据分析师考试作为衡量数据专业能力的 ...
2025-07-04SQL Server 字符串截取转日期:解锁数据处理的关键技能 在数据处理与分析工作中,数据格式的规范性是保证后续分析准确性的基础 ...
2025-07-04CDA 数据分析师视角:从数据迷雾中探寻商业真相 在数字化浪潮席卷全球的今天,数据已成为企业决策的核心驱动力,CDA(Certifie ...
2025-07-04CDA 数据分析师:开启数据职业发展新征程 在数据成为核心生产要素的今天,数据分析师的职业价值愈发凸显。CDA(Certified D ...
2025-07-03从招聘要求看数据分析师的能力素养与职业发展 在数字化浪潮席卷全球的当下,数据已成为企业的核心资产,数据分析师岗位也随 ...
2025-07-03Power BI 中如何控制过滤器选择项目数并在超限时报错 引言 在使用 Power BI 进行数据可视化和分析的过程中,对过滤器的有 ...
2025-07-03把握 CDA 考试时间,开启数据分析职业之路 在数字化转型的时代浪潮下,数据已成为企业决策的核心驱动力。CDA(Certified Da ...
2025-07-02CDA 证书:银行招聘中的 “黄金通行证” 在金融科技飞速发展的当下,银行正加速向数字化、智能化转型,海量数据成为银行精准 ...
2025-07-02探索最优回归方程:数据背后的精准预测密码 在数据分析和统计学的广阔领域中,回归分析是揭示变量之间关系的重要工具,而回 ...
2025-07-02CDA 数据分析师报考条件全解析:开启数据洞察之旅 在当今数字化浪潮席卷全球的时代,数据已成为企业乃至整个社会发展的核心驱 ...
2025-07-01深入解析 SQL 中 CASE 语句条件的执行顺序 在 SQL 编程领域,CASE语句是实现条件逻辑判断、数据转换与分类的重要工 ...
2025-07-01SPSS 中计算三个变量交集的详细指南 在数据分析领域,挖掘变量之间的潜在关系是获取有价值信息的关键步骤。当我们需要探究 ...
2025-07-01CDA 数据分析师:就业前景广阔的新兴职业 在当今数字化时代,数据已成为企业和组织决策的重要依据。数据分析师作为负责收集 ...
2025-06-30探秘卷积层:为何一个卷积层需要两个卷积核 在深度学习的世界里,卷积神经网络(CNN)凭借其强大的特征提取能力 ...
2025-06-30探索 CDA 数据分析师在线课程:开启数据洞察之旅 在数字化浪潮席卷全球的当下,数据已成为企业决策、创新与发展的核心驱 ...
2025-06-303D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32% 编辑:LRST 【新智元导读】中科院自动化所提出BridgeVLA模型,通过将 ...
2025-06-30LSTM 为何会产生误差?深入剖析其背后的原因 在深度学习领域,LSTM(Long Short-Term Memory)网络凭借其独特的记忆单元设 ...
2025-06-27LLM进入拖拽时代!只靠Prompt几秒定制大模型,效率飙升12000倍 【新智元导读】最近,来自NUS、UT Austin等机构的研究人员创新 ...
2025-06-27探秘 z-score:数据分析中的标准化利器 在数据的海洋中,面对形态各异、尺度不同的数据,如何找到一个通用的标准来衡量数据 ...
2025-06-26Excel 中为不同柱形设置独立背景(按数据分区)的方法详解 在数据分析与可视化呈现过程中,Excel 柱形图是展示数据的常用工 ...
2025-06-26