京公网安备 11010802034615号
经营许可证编号:京B2-20210330
文章来源: 数据分析与统计学之美
作者:黄伟呢
目录
1.scipy库中各分布对应的方法
from scipy import stats # 正态分布 stats.norm # 卡方分布 stats.chi2 # t分布 stats.t # F分布 stats.f
2.stats库中各分布的常用方法及其功能
对于正态分布:
stats.norm.cdf(α,均值,方差);
stats.norm.pdf(α,均值,方差);
stats.norm.isf(α,均值,方差);
对于t分布:
stats.t.cdf(α,自由度);
stats.t.pdf(α,自由度);
stats.t.isf(α,自由度);
对于F分布:
stats.f.cdf(α,自由度1.自由度2);
stats.f.pdf(α,自由度1.自由度2);
stats.f.isf(α,自由度1.自由度2);
一个简单的案例说明:
# 对于正态分布 stats.norm.cdf(0.5.2.3) stats.norm.pdf(0.5.2.3) stats.norm.isf(0.05.2.3) # 对于t分布 stats.t.cdf(0.5.10) stats.t.pdf(0.5.10) stats.t.isf(0.0005.45)
结果如下:
3.正态分布的概率密度函数及其图象
1)正态分布的概率密度函数及其图象
x = np.linspace(-5.5.100000)
y = stats.norm.pdf(x,0.1)
plt.plot(x,y,c="red")
plt.title('正态分布的概率密度函数')
plt.tight_layout()
plt.savefig("正态分布的概率密度函数",dpi=300)
结果如下:
4.卡方分布的概率密度函数及其图象
1)卡方分布的概率密度函数及其图象
2)python绘制卡方分布的概率密度函数图象
x = np.linspace(0.100.100000)
color = ["blue","green","darkgrey","darkblue","orange"]
for i in range(10.51.10):
y=stats.chi2.pdf(x,df=i)
plt.plot(x,y,c=color[int((i-10)/10)])
plt.title('卡方分布')
plt.tight_layout()
plt.savefig(" 布的概率密度函数",dpi=300)
结果如下:
总结:从图中可以看出,随着自由度的增加,卡方分布的概率密度曲线趋于对称。当自由度n -> +∞的时候,卡方分布的极限分布就是正态分布。
5.t分布的概率密度函数及其图象
1)t分布的概率密度函数及其图象
2)python绘制t分布的概率密度函数图象
x = np.linspace(-5.5.100000)
y = stats.t.pdf(x_t,2)
plt.plot(x,y,c="orange")
plt.title('t分布的概率密度函数')
plt.tight_layout()
plt.savefig("t分布的概率密度函数",dpi=300)
结果如下:
x_norm = np.linspace(-5.5.100000)
y_norm = stats.norm.pdf(x_norm,0.1)
plt.plot(x_norm,y_norm,c="black")
color = ["green","darkblue","orange"]
x_t = np.linspace(-5.5.100000)
for i in range(1.4.1):
y_t = stats.t.pdf(x_t,i)
plt.plot(x_t,y_t,c=color[int(i-1)])
plt.title('t分布和正态分布的概率密度函数对比图')
plt.tight_layout()
plt.savefig("t分布和正态分布的概率密度函数对比图",dpi=300)
结果如下:
总结:从图中可以看出,t分布的概率密度函数和正态分布的概率密度函数都是偶函数(左右对称的)。t分布随着自由度的增加,就越来越接近正态分布,即t分布的极限分布也是正态分布。
6.F分布的概率密度函数及其图象
1)F分布的概率密度函数及其图象
x = np.linspace(-1.8.100000)
y1 = stats.f.pdf(x,1.10)
y2 = stats.f.pdf(x,5.10)
y3 = stats.f.pdf(x,10.10)
plt.plot(x,y1)
plt.plot(x,y2)
plt.plot(x,y3)
plt.ylim(0.1)
plt.title('F分布的概率密度函数')
plt.tight_layout()
plt.savefig("F分布的概率密度函数",dpi=300)
结果如下:
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数字化市场调研体系中,大数据与小数据是两类核心调研数据形态,分别对应海量行为统计与精准样本深度调研。行业普遍存在认知误 ...
2026-08-07数据透视表是Excel、WPS中最核心的数据分析工具,凭借快速汇总、分组统计、动态筛选的优势,被广泛应用于销量统计、业绩复盘、数 ...
2026-08-07 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标在所有行业都适用”“哪些指标只对电商有意义”“二者如何搭 ...
2026-08-07在商品销量、市场需求、营收规模等业务数据中,季节性波动是最普遍、最核心的数据特征。零售快消、食品餐饮、家电服饰、电商行业 ...
2026-08-06在流量红利消退、市场竞争白热化的商业环境中,传统依托经验、跟风投放、广撒网式的营销模式,逐渐暴露出成本高、精准度低、转化 ...
2026-08-06 很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“什么是指标”“指标和维度有什么区别”“如何定义指标值的计算规则和 ...
2026-08-06【核心关键词】知识、设备、工程师、数字化、建模、算法、工业大数据、数据分析、控制算法、机器学习、深度学习、业务目标、工 ...
2026-08-05增长率是数据分析、业务报表、可视化看板中最核心的指标之一,常用于衡量营收、销量、用户量、流量等业务数据的涨跌幅度与发展趋 ...
2026-08-05小陈是某电商平台的数据分析师。老板交给他一个任务:“我们平台的注册用户已经突破1000万了,想了解一下用户的平均月消费金额。 ...
2026-08-05在机器学习建模、数据预处理、抽样划分、模型初始化训练的全流程中,随机种子是控制实验随机性、保证结果可复现、提升模型稳定性 ...
2026-08-04Python作为面向对象的主流编程语言,核心编程体系由变量、方法、类三大基础要素构成。三者层层递进、相互协作,支撑起所有基础代 ...
2026-08-04 很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问 ...
2026-08-04为什么学习数据分析? 当下,我们已然步入数据要素价值全面释放的智能时代。数据不再只是零散的数字记录,更是驱动新质生产力运 ...
2026-08-03CDA等级认证证书有效期为三年,三年进行一次年审,主要考察CDA持证人的职业发展情况;学历、工作单位及职业变更情况;继续教育 ...
2026-08-03【核心关键词】金融、岗位、企业、算法、知识、专业、理论、课程、软件、数据分析、业务类型、应用场景、经营管理、大型企业、 ...
2026-08-03在日常数据分析、业务报表复盘、业绩预测工作中,平均增长率是衡量数据长期变化趋势的核心指标,广泛用于营收增长、用户增长、销 ...
2026-08-03很多人把统计学理解为“一堆公式和计算”,却忽略了它的本质——一门让数据“开口说话”的科学。真正的数据分析高手,不是会算平 ...
2026-08-03在数据指标体系搭建工作中,从业者常困惑于指标搭建的核心逻辑:究竟是依托一线零散数据自下而上汇总指标,还是基于战略目标自上 ...
2026-07-31在数据分析、问卷研究、实验复盘、业务建模的工作中,大多数人最关注的是“用什么统计方法”:是做T检验、方差分析、卡方检验, ...
2026-07-31 许多数据分析师精通Excel函数和SQL查询,但当面对一张上万行的销售明细表,要快速回答“哪个地区销量最高”“哪款产品增长最 ...
2026-07-31