
惯例先来简单介绍下什么是散点图:用两组数据构成多个坐标点,考察坐标点的分布,判断两变量之间是否存在某种关联或总结坐标点的分布模式。散点图将序列显示为一组点。值由点在图表中的位置表示。类别由图表中的不同标记表示。(来源:百度百科)
散点图很主要的是可以很直观的查看两组数据之间的关系,另外还可以很显示数据的分布情况。干巴巴的描述来描述去也没有一个图来的直观容易理解:
例如这张图,x轴数据和y轴数据就存在很强的正向关!
而这幅散点图,显示数据分布,对于分类有很大的帮助。
既然已经知道了散点图的主要作用,那么下边让我们来绘制一个散点图吧,一步一步,从简单到进阶!
先来看一下我们的数据源,依然是一组小学的语数外考试成绩:
基于上述数据源,绘制语文成绩与总成绩的散点图:
绘制几个图之后,大家就会发现,常规的画布啊标题啊标签之类的设置都是通用的,只有画图函数是不一样的,而大多数时候图想画出花样来着,也是在各个参数上做文章,先来看下这个简单的散点图画出来是什么样子的吧:
通过这个图能够看出,语文成绩和总成绩之间存在一定的线性关系,当然和前边那个示例图相比没有那么明显。这是语文成绩和总成绩的图,但是我们数据一共有三个学科数据,可不可以把三个学科的图绘制到一起呢?
当然是可以的啊,和绘制堆叠条形图和环形图的原理是一样的,下边我们来绘制一下三个学科和总成绩之间的散点图。
代码含义都以注释的形式标注到对应代码后了,其实就是在同一块画布上重复绘制散点图,散点和环形或者条形图不同,后边绘制的图形覆盖先绘制图形的情形几乎可以忽略,所以不用进行其他设置,直接绘图就可以,代码中对代表每一个学科的散点形状进行了指定,其实还可以指定颜色,实验发现系统默认的颜色还不错,就没有指定颜色(发现自己指定的颜色还不如系统指定的好看,有点悲伤):
通过这个图能够很明显的看出数学成绩与总成绩之间的线性关系更强,有点符合上学时候的真实情况了,数学才是拉开分差的学科啊!
其实气泡图是从散点图衍生出来的,散点图只有两个维度的数据,x轴和y轴,气泡图比散点图多了一个维度,即标记点的大小可以代表一个维度,衡量大小。
以学校成绩数据为例,我们给散点图添加一个维度,即给标记的大小赋值来看下有什么变化。比如语文成绩:
效果图:
代码中我们赋值给参数s的是语文成绩,而y轴也是语文成绩,所以能够看到,点的位置越靠近上方,点越大,如果我们赋值给s的值是总成绩的画,那么点的位置越靠右,点就会越大。
这里为了和前边的图进行对比,用了二维的数据绘图,有兴趣的小伙伴可以找一个三个维度的数据试一下,自己敲一遍收获更大哦!
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
DBeaver 实战:实现两个库表结构同步的高效路径 在数据库管理与开发工作中,保持不同环境(如开发库与生产库、主库与从库)的表 ...
2025-08-08t 检验与卡方检验:数据分析中的两大统计利器 在数据分析领域,统计检验是验证假设、挖掘数据规律的重要手段。其中,t 检验和卡 ...
2025-08-08CDA 数据分析师:解锁数据价值的专业力量 在当今这个数据爆炸的时代,数据已成为像石油一样珍贵的战略资源。而 CDA 数据分析师, ...
2025-08-08人工智能对CDA数据分析领域的影响 人工智能对 CDA(Certified Data Analyst,注册数据分析师)数据分析领域的影响是全方位、多层 ...
2025-08-07SPSS 语法使用详解 在当今数据驱动的时代,SPSS( Statistical Package for the Social Sciences)作为一款功能强大的统计分析软 ...
2025-08-07SASEM 决策树:理论与实践应用 在复杂的决策场景中,如何从海量数据中提取有效信息并制定科学决策,是各界关注的焦点。SASEM 决 ...
2025-08-07CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-07大数据时代对定性分析的影响 在大数据时代,海量、多样、高速且低价值密度的数据充斥着我们的生活与工作。而定性分析作为一 ...
2025-08-07K-S 曲线、回归与分类:数据分析中的重要工具 在数据分析与机器学习领域,K-S 曲线、回归和分类是三个核心概念与工具,它们各 ...
2025-08-07CDA 数据分析师考试全解析 在当今数字化时代,数据已成为企业发展的核心驱动力,数据分析师这一职业也愈发受到重视。CDA 数据分 ...
2025-08-07大数据时代的隐患:繁荣背后的隐忧 当我们在电商平台浏览商品时,系统总能 “精准” 推送心仪的物品;当我们刷短视频时,算法 ...
2025-08-07解析 F 边界检验:协整分析中的实用工具 在计量经济学的时间序列分析中,判断变量之间是否存在长期稳定的均衡关系(即协整关系) ...
2025-08-07CDA 数据分析师报考条件详解:迈向专业认证的指南 在数据分析行业蓬勃发展的当下,CDA 数据分析师认证成为众多从业者提升专业 ...
2025-08-07通过 COX 回归模型诊断异常值 一、COX 回归模型概述 COX 回归模型,又称比例风险回归模型,是一种用于生存分析的统计方法。它能 ...
2025-08-07评判两组数据与初始数据准确值的方法 在数据分析与研究中,我们常常会面临这样的情况:需要对通过不同方法、不同过程得到的两组 ...
2025-08-07CDA 数据分析师行业标准:构建数据人才的能力坐标系 在数据驱动决策成为企业核心竞争力的时代,CDA(数据分析师)行业标准作为 ...
2025-08-07反向传播神经网络:突破传统算法瓶颈的革命性力量 在人工智能发展的历史长河中,传统算法曾长期主导着数据处理与模式识别领域 ...
2025-08-07MySQL 统计连续每天数据:从业务需求到技术实现 在数据分析场景中,连续日期的数据统计是衡量业务连续性的重要手段 —— 无论是 ...
2025-08-07抖音数据分析师:驱动平台增长的幕后推手 在抖音这个日活用户数以亿计的超级平台上,每一次用户的滑动、点赞、评论,每一条 ...
2025-08-07基于 SPSS 的中介效应分析结果解读:揭示变量间的隐性关联 在社会科学与自然科学研究中,变量之间的关系往往并非简单的直接作用 ...
2025-08-07