上一篇介绍了数据的分类、统计学是什么、以及统计学知识的大分类,本篇我们重点学习描述性统计学。
我们描述一组数据的时候,通常分三个方面描述:集中趋势、离散趋势、分布形状。通俗来说,集中趋势是描述数据集中在什么位置,离散趋势描述的是数据分散的程度,分布形状描述的是数据形状。
首先,来看描述数据的集中趋势,使用的三个常见的统计量:
Excel求算术平均数的函数=AVERAGE(A1:A8)
PS:聪明的你肯定知道把上面8个数据
2,23,4,17,12,12,13,16
,用左手复制到你Excel中的A1:A8单元格(记得竖着放!)
用Python求算术平均数
## 使用 numpy 库里的 mean 函数
import numpy as np
data = [2,23,4,17,12,12,13,16]
print(np.mean(data))
# 12.375
Excel求几何平均数的函数=GEOMEAN(A1:A8)
用Python求几何平均数
# 使用 scipy 库里的 gmean 函数求几何平均数
from scipy import stats as sts
data = [2,23,4,17,12,12,13,16]
print(sts.gmean(data))
# 9.918855683110795
n个数的倒数的算术平均数的倒数
Excel求调和平均数的函数=HARMEAN(A1:A8)
Python求调和平均数
# 使用 scipy 库里的 hmean 函数求调和平均数
from scipy import stats as sts
data = [2,23,4,17,12,12,13,16]
print(sts.hmean(data))
# 6.906127821278071
还没看晕吧?我们小结一下,三者的大小排序一般是算术平均值 ≥ 几何平均值 ≥ 调和平均值
。另外
数值类数据的均值一般用算术平均值,比例型数据的均值一般用几何平均值,平均速度一般用调和平均数
中位数是把数据按照顺序排列,处于中间位置的那个数
Excel求中位数的函数=MEDIAN(A1:A8)
Python求中位数
# 使用 numpy 库里的 median 函数求中位数
import numpy as np
data = [2,23,4,17,12,12,13,16]
print(np.median(data))
# 12.5
众数是一组数据中出现次数最多的变量值。
Excel求众数的函数=MODE(A1:A8)
数据分析的崛起 CDA认证概述 Level I:基础级 Level II:中级 Level III:高级 C ...
2024-10-08数据分析的崛起 然而,数据分析不仅仅是简单的数据处理和统计,更需要深厚的专业知识和实际操作能力。正因为如此,数据分 ...
2024-10-08随着大数据时代的到来,数据分析师这一职业逐渐成为各行各业中不可或缺的角色。数据分析师不仅需要掌握丰富的数据处理和分析技能 ...
2024-10-08数据分析已经成为现代商业和技术领域中不可或缺的一部分。数据分析师通过对大量数据进行整理、分析和解释,帮助企业做出明智的决 ...
2024-10-08数据分析师的角色与核心技能 核心技能 为什么选择CDA数据分析师认证? CDA认证的优势 CDA认证 ...
2024-10-08数据分析师的角色与核心技能 核心技能 为什么选择CDA数据分析师认证? CDA认证的优势 如何报 ...
2024-10-08什么是数据分析师? 数据分析师的核心技能 为什么选择CDA数据分析师认证? CDA认证的优势 如 ...
2024-10-08大数据分析师在现代企业中扮演着至关重要的角色。他们通过分析大量数据,帮助企业做出明智的决策。要成为一名成功的大数据分析师 ...
2024-10-088. 再看t检验、F检验、检验 前面在假设检验的部分经学过t检验、F检验、检验,之所以再看,是想通过纵向对比这几个检验统计量以加 ...
2024-10-08数据分析工程师的工作内容主要涉及多个方面,包括数据的收集、处理、分析和报告撰写等。具体来说,他们的职责可以分为以下几个方 ...
2024-10-077. 相关性分析 前面的假设检验、方差分析基本上都是围绕差异性分析,不论是单个总体还是两个总体及以上,总之都是属于研究“区别 ...
2024-10-07很多考了CDA数据分析一级的伙伴经常问的就是:如何来找一些数据分析的项目来做,练习所学习的数据分析技能,并能写出一份数据分 ...
2024-10-07数据分析是一个涉及从数据收集、清理到分析、可视化和解释的复杂过程。随着数据在各行各业中的重要性不断增加,数据分析工具也变 ...
2024-10-066. 方差分析 单因素多水平方差分析 例6.1 不同装配方式对生产的过滤系统数量的差异性检验 某城市过滤水系统生产公司,有A、B、C3 ...
2024-10-06不过,在出题前,要公布上一期LEVEL II中61-65题的答案,大家一起来看! 62、B 64、B 你答对了吗? 66.关于单因素 ...
2024-10-05嗨喽,各位同学又到了公布CDA数据分析师认证考试LEVEL II的模拟试题时间了,今天给大家带来的是模拟试题(一)中的146-150 ...
2024-10-055. 假设检验 久经考场的你肯定对于很多概念类题目里问到的 “区别和联系” 不陌生,与之类似,在统计领域要研究的是数据之间的区 ...
2024-10-05数据模型(Data Model)是对现实世界数据特征的抽象,用于描述一组数据的概念和定义。它从抽象层次上描述了系统的静态特征、动态 ...
2024-10-044. 区间估计 还以为你被上节课的内容唬住了~终于等到你,还好没放弃! 本节我们将说明两个问题:总体均值 的区间估计和总体比例 ...
2024-10-04