京公网安备 11010802034615号
经营许可证编号:京B2-20210330
作者:丁点helper
来源: 丁点帮你
前面2篇R语言相关的文章以泰坦尼克号的数据为例,介绍了描述性统计中用到的计算操作,以及柱形图的绘制操作。今天我们继续聊聊如何在R中绘制直方图和散点图。
绘制直方图
仍使用titanic.csv这个数据。
# 导入数据
titanic <- read.csv("//Users//Desktop//titanic.csv",header = TRUE)
names(titanic) # 查看titanic中的变量名
[1] "pclass" "survived" "sex" "age" "sibsp" "parch"
假设我们想对age这个变量绘制直方图,了解泰坦尼克号上乘客的年龄分布,可用hist()这个函数:
hist(titanic$age)
上图中直方图标题、颜色、坐标轴名称均可调整:
hist(titanic$age, col='orange', main='Passenger Age',
lwd=2, xlab='Age (years)')
其中,col、main、xlab这三个命令在之前的文章中讲过;lwd为线条宽度命令,取值须为整数,默认值为1。
绘制散点图
接下来我们看看如何绘制散点图。还是老规矩,要用到的数据可通过以下方式下载:
文件名: wb.csv
链接: https://pan.baidu.com/s/1gOAuccW5i8cIW5HaPHnm8A
密码: nc5u
这是世界银行(word bank)对部分国家社会、经济、环境指标的统计数据。
# 导入数据
wb <- read.csv("//Users//Desktop//wb.csv",header = TRUE)
names(wb) # 查看wb中的变量名
[1] "Country" "Code" "Population" "Rural" "GNI" "IncomeTop10" "Imports"
[8] "Exports" "Military" "Cell" "Fertility66" "Fertility16" "Measles" "InfMort"
[15] "LifeExp" "PM2.5" "Diesel" "CO2" "EnergyUse" "FossilPct" "Forest94"
[22] "Forest14" "Deforestation" "GunTotal" "GunHomicide" "GunSuicide" "GunUnint" "GunUndet"
[29] "GunsPer100"
这里我们先关注第五个变量『GNI』,其意义是人均国民收入。GNI是Gross National Income的缩写;再关注第18个变量『CO2』,其意义是人均二氧化碳排放量。
一项研究想观察人均国民收入和人均二氧化碳排放量之间存在何种关系,由于二者均为数值型变量,我们可以用散点图的方式直观感受一下:
plot(wb$GNI,wb$CO2, main="CO2 vs. GNI (both per capita)",
xlab="Gni per capita", ylab="CO2 per capita",
col="red", pch=19)
# col命令的取值还可以是数字,本例中red对应的数字是2
plot(wb$GNI,wb$CO2, main="CO2 vs. GNI (both per capita)",
xlab="Gni per capita", ylab="CO2 per capita",
col=2, pch=19)
上面两条代码的运行结果是一样的。wb$GNI 和 wb$CO2 分别为散点图的横轴和纵轴;pch表示点的形状,取值为整数,本例中用到的19表示圆点。
下面用一个图片来给大家介绍1-20的数字分别代表什么颜色、什么形状:
plot(c(1:20),rep(1,20),col=c(1:20),pch=c(1:20),cex=2)
cex表示对图中的文本或符号放大多少倍,大家可自行在R中操作,感受cex=1时图像的变化。
举个例子,col=15:黄色;pch=15:方块。在R中,可选的颜色还有很多,大家可以查看下图中的颜色名称,绘图时在col命令中输入即可。
手机用户可横屏查看效果更佳,告别大红大蓝秋裤色就靠它了~
今天就学到这里啦,之后还有更多R绘图课程来和大家见面!
——热门课程推荐:
想从事业务型数据分析师,您可以点击>>>“数据分析师”了解课程详情;
想从事大数据分析师,您可以点击>>>“大数据就业”了解课程详情;
想成为人工智能工程师,您可以点击>>>“人工智能就业”了解课程详情;
想了解Python数据分析,您可以点击>>>“Python数据分析师”了解课程详情;
想咨询互联网运营,你可以点击>>>“互联网运营就业班”了解课程详情;
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
“垃圾数据进,垃圾结果出”,这是数据分析领域的黄金法则,更是CDA(Certified Data Analyst)数据分析师日常工作中时刻恪守的 ...
2026-03-18在机器学习建模中,决策树模型因其结构直观、易于理解、无需复杂数据预处理等优势,成为分类与回归任务的首选工具之一。而变量重 ...
2026-03-17在数据分析中,卡方检验是一类基于卡方分布的假设检验方法,核心用于分析分类变量之间的关联关系或实际观测分布与理论期望分布的 ...
2026-03-17在数字化转型的浪潮中,企业积累的数据日益庞大且分散——用户数据散落在注册系统、APP日志、客服记录中,订单数据分散在交易平 ...
2026-03-17在数字化时代,数据分析已成为企业决策、业务优化、增长突破的核心支撑,从数据仓库搭建(如维度表与事实表的设计)、数据采集清 ...
2026-03-16在数据仓库建设、数据分析(尤其是用户行为分析、业务指标分析)的实践中,维度表与事实表是两大核心组件,二者相互依存、缺一不 ...
2026-03-16数据是CDA(Certified Data Analyst)数据分析师开展一切工作的核心载体,而数据读取作为数据生命周期的关键环节,是连接原始数 ...
2026-03-16在用户行为分析实践中,很多从业者会陷入一个核心误区:过度关注“当前数据的分析结果”,却忽视了结果的“泛化能力”——即分析 ...
2026-03-13在数字经济时代,用户的每一次点击、浏览、停留、转化,都在传递着真实的需求信号。用户行为分析,本质上是通过收集、整理、挖掘 ...
2026-03-13在金融、零售、互联网等数据密集型行业,量化策略已成为企业挖掘商业价值、提升决策效率、控制经营风险的核心工具。而CDA(Certi ...
2026-03-13在机器学习建模体系中,随机森林作为集成学习的经典算法,凭借高精度、抗过拟合、适配多场景、可解释性强的核心优势,成为分类、 ...
2026-03-12在机器学习建模过程中,“哪些特征对预测结果影响最大?”“如何筛选核心特征、剔除冗余信息?”是从业者最常面临的核心问题。随 ...
2026-03-12在数字化转型深度渗透的今天,企业管理已从“经验驱动”全面转向“数据驱动”,数据思维成为企业高质量发展的核心竞争力,而CDA ...
2026-03-12在数字经济飞速发展的今天,数据分析已从“辅助工具”升级为“核心竞争力”,渗透到商业、科技、民生、金融等各个领域。无论是全 ...
2026-03-11上市公司财务报表是反映企业经营状况、盈利能力、偿债能力的核心数据载体,是投资者决策、研究者分析、从业者复盘的重要依据。16 ...
2026-03-11数字化浪潮下,数据已成为企业生存发展的核心资产,而数据思维,正是CDA(Certified Data Analyst)数据分析师解锁数据价值、赋 ...
2026-03-11线性回归是数据分析中最常用的预测与关联分析方法,广泛应用于销售额预测、风险评估、趋势分析等场景(如前文销售额预测中的多元 ...
2026-03-10在SQL Server安装与配置的实操中,“服务名无效”是最令初学者头疼的高频问题之一。无论是在命令行执行net start启动服务、通过S ...
2026-03-10在数据驱动业务的当下,CDA(Certified Data Analyst)数据分析师的核心价值,不仅在于解读数据,更在于搭建一套科学、可落地的 ...
2026-03-10在企业经营决策中,销售额预测是核心环节之一——无论是库存备货、营销预算制定、产能规划,还是战略布局,都需要基于精准的销售 ...
2026-03-09