京公网安备 11010802034615号
经营许可证编号:京B2-20210330
作者:小伍哥
来源:AI入门学习
上次出了一个在网站「Flourish」画动态条形图的文章【动态条形图视频教程】,需要登录网址很多人可能觉得不方便,现在有大佬出了个python包,只需几行代码就能搞定动态条形图,非常强大,给大家分享下。
一、前期准备工作
1、官方参考文档
GitHub :https://github.com/dexplo/bar_chart_race
说明文档:https://www.dexplo.org/bar_chart_race/
2、软件安装(该安装方法只能安装0.1版本)
pip install bar_chart_race conda install -c conda-forge bar_chart_race
0.2版本需要到github安装
压缩包解压到软件安装目录的/site-packages目录下,利用命令行安装即可
3、安装ffmpeg、ImageMagick
ffmpeg包:不然无法输出 mp4/m4v/mov/等格式的视频,该包比较复杂,需要配置变量环境,具体操作可以看看这个博客:
https://baijiahao.baidu.com/s?id=1660327134602942057&wfr=spider&for=pc
ImageMagick包:如果你要创建GIF,需要安装这个包ImageMagick,安装方法与上述类似。
二、官方数据画图
上述准备都做好了,那就可以开始画图了,利用官方提供的数据,直接加载就可以,我的数据下载没成功,所以自己上传数据绘图,等下回讲怎么自己上传数据。
#加载包
import bar_chart_race as bcr
#下载数据
df = bcr.load_dataset('covid19_tutorial')
#生成GIF图像
bcr.bar_chart_race(df, 'covid19_horiz.gif')
#生成MP4
bcr.bar_chart_race(df, 'covid19_horiz.MP4')
生成的GIF
生成的MP4
三、自己的数据画图
如果是自己的数据,要进行一定的处理,达到画图格式,不然会报错。
#读取数据
df = pd.read_csv('data.csv')
#格式处理,需要把日期date转换成索引,不能作为单独一列
df = df.set_index(keys='date')
作者也提供了两个处理数据的函数
bcr.prepare_wide_data bcr.prepare_long_data
原始数据
处理后数据(date转换成了索引)
四、图形美化
作者还提供了很多参数,对图形进行调整和美化,输出的图形更漂亮
1、横转纵 Vertical bars
#orientation='v',.gif变成MP4即可输出视频 bcr.bar_chart_race(df, 'covid19_horiz.gif', orientation='v')
2、升序排序
# 排序方式,sort='asc'-升序 bcr.bar_chart_race(df, 'covid19_horiz.gif', sort='asc')
3、类目数限制,此处设置为最多出现6条
# 设置最多能显示的条目数 n_bars=6 bcr.bar_chart_race(df, 'covid19_horiz.gif', n_bars=6)
4、设置展示类目
# 选取如下5个国家的数据 fixed_order bcr.bar_chart_race(df, 'covid19_horiz.gif', fixed_order=['Iran', 'USA', 'Italy', 'Spain', 'Belgium'])
5、固定坐标轴
#设置数值的最大值,固定数值轴fixed_max bcr.bar_chart_race(df, 'covid19_horiz.gif', fixed_max=True)
6、改变图像帧数
#图像帧数,数值越小,越不流畅。越大,越流畅。默认为10比较流畅,改为3就有些卡顿了 bcr.bar_chart_race(df, 'covid19_horiz.gif', steps_per_period=3)
7、设置帧率,默认为500ms
# 设置20帧的总时间,此处为200ms bcr.bar_chart_race(df, 'covid19_horiz.gif', steps_per_period=20, period_length=200)
8、设置每帧增加的标签时间,默认为False
# 输出gif bcr.bar_chart_race(df, 'covid19_horiz.gif', interpolate_period=True)
9、绘图属性设置
# figsize-设置画布大小,默认(6, 3.5) # dpi-图像分辨率,默认144 # label_bars-显示柱状图的数值信息,默认为True # period_label-显示时间标签信息,默认为True # title-图表标题 bcr.bar_chart_race(df, 'covid19_horiz.gif', figsize=(5, 3), dpi=100, label_bars=False, period_label={'x': .99, 'y': .1, 'ha': 'right', 'color': 'red'}, title='COVID-19 Deaths by Country')
10、配置标签文字大小
# bar_label_size-柱状图标签文字大小 # tick_label_size-坐标轴标签文字大小 # title_size-标题标签文字大小 bcr.bar_chart_race(df, 'covid19_horiz.gif', bar_label_size=4, tick_label_size=5, title='COVID-19 Deaths by Country', title_size='smaller')
11、全局字体属性设置
# shared_fontdict-全局字体属性
bcr.bar_chart_race(df, 'covid19_horiz.gif',
title='COVID-19 Deaths by Country',
shared_fontdict={'family': 'Helvetica', 'weight': 'bold',
'color': 'rebeccapurple'})
12、透明度,边框等设置
# bar_kwargs-条形图属性设置参数 bcr.bar_chart_race(df, 'covid19_horiz.gif', bar_kwargs={'alpha': .2, 'ec': 'black', 'lw': 3})
13、日期格式设置
# 设置日期格式,默认为'%Y-%m-%d' bcr.bar_chart_race(df, 'covid19_horiz.gif', period_fmt='%b %-d, %Y')
14、改日期标签为数值格式
# 设置日期标签为数值
bcr.bar_chart_race(df.reset_index(drop=True),
'covid19_horiz.gif', interpolate_period=True,
period_fmt='Index value - {x:.2f}')
15、添加汇总统计
#设置文本位置、数值、大小、颜色等
def summary(values, ranks):
total_deaths = int(round(values.sum(), -2))
s = f'Total Deaths - {total_deaths:,.0f}'
return {'x': .99, 'y': .05, 's': s, 'ha': 'right', 'size': 8}
# 添加文本
bcr.bar_chart_race(df,
'covid19_horiz.gif',
period_summary_func=summary
16、添加垂直条参考线(平均值、分位数等)
# 设置垂直条数值,分位数
def func(values, ranks):
return values.quantile(.9)
# 添加垂直条
bcr.bar_chart_race(df, 'covid19_horiz.gif',
perpendicular_bar_func=func)
17、设置柱状图颜色
'dark12' is the default colormap. If there are more than 10 columns, then the default colormap will be 'dark24'
# 设置柱状图颜色 bcr.bar_chart_race(df, 'covid19_horiz.gif', cmap='accent')
18、颜色不重复
#filter_column_colors保证颜色不重复
bcr.bar_chart_race(df, 'covid19_horiz.gif',
cmap='accent',
filter_column_colors=True)
19、中文支持配置
中文配置只需在第三方库的_make_chart.py文件中,加入如下三行代码。
#中文显示 plt.rcParams['font.sans-serif'] = ['SimHei'] #Windows plt.rcParams['font.sans-serif'] = ['Hiragino Sans GB'] #Mac plt.rcParams['axes.unicode_minus'] = False
20、自定义颜色
此外通过在「_colormaps.py」文件中添加颜色信息,经cmap引用,即可自定义配置颜色。
colormaps = {
"new_colors": [
'#ff812c',
'#ff5a5a',
'#00c5d2',
'#a64dff',
'#4e70f0',
'#f95dba',
'#ffce2b']}
CDA学员免费下载查看报告全文:2026全球数智化人才指数报告【CDA数据科学研究院】.pdf——热门课程推荐:
想从事业务型数据分析师,您可以点击>>>“数据分析师”了解课程详情;
想从事大数据分析师,您可以点击>>>“大数据就业”了解课程详情;
想成为人工智能工程师,您可以点击>>>“人工智能就业”了解课程详情;
想了解Python数据分析,您可以点击>>>“Python数据分析师”了解课程详情;
想咨询互联网运营,你可以点击>>>“互联网运营就业班”了解课程详情;
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在游戏行业竞争白热化的当下,用户流失已成为制约游戏生命周期、影响营收增长的核心痛点。据行业报告显示,2024年移动游戏平均次 ...
2026-04-24 很多业务负责人开会常说“我们要数据驱动”,最后却变成“看哪张报表数据多就用哪个”,往往因为缺乏一套结构性的方法去搭建 ...
2026-04-24在Power BI数据可视化分析中,切片器是连接用户与数据的核心交互工具,其核心价值在于帮助使用者快速筛选目标数据、聚焦分析重点 ...
2026-04-23以数为据,以析促优——数据分析结果指导临床技术改进的实践路径 临床技术是医疗服务的核心载体,其水平直接决定患者诊疗效果、 ...
2026-04-23很多数据分析师每天盯着GMV、DAU、转化率,但当被问到“哪些指标是所有企业都需要的”“哪些指标是因行业而异的”“北极星指标和 ...
2026-04-23近日,由 CDA 数据科学研究院重磅发布的《2026 全球数智化人才指数报告》,被中国教育科学研究院官方账号正式收录, ...
2026-04-22在数字化时代,客户每一次点击、浏览、下单、咨询等行为,都在传递其潜在需求与决策倾向——这些按时间顺序串联的行为轨迹,构成 ...
2026-04-22数据是数据分析、建模与业务决策的核心基石,而“数据清洗”作为数据预处理的核心环节,是打通数据从“原始杂乱”到“干净可用” ...
2026-04-22 很多数据分析师每天盯着GMV、转化率、DAU等数字看,但当被问到“什么是指标”“指标和维度有什么区别”“如何搭建一套完整的 ...
2026-04-22在数据分析与业务决策中,数据并非静止不变的数值,而是始终处于动态波动之中——股市收盘价的每日涨跌、企业月度销售额的起伏、 ...
2026-04-21在数据分析领域,当研究涉及多个自变量与多个因变量之间的复杂关联时,多变量一般线性分析(Multivariate General Linear Analys ...
2026-04-21很多数据分析师精通描述性统计,能熟练计算均值、中位数、标准差,但当被问到“用500个样本如何推断10万用户的真实满意度”“这 ...
2026-04-21在数据处理与分析的全流程中,日期数据是贯穿业务场景的核心维度之一——无论是业务报表统计、用户行为追踪,还是风控规则落地、 ...
2026-04-20在机器学习建模全流程中,特征工程是连接原始数据与模型效果的关键环节,而特征重要性分析则是特征工程的“灵魂”——它不仅能帮 ...
2026-04-20很多数据分析师沉迷于复杂的机器学习算法,却忽略了数据分析最基础也最核心的能力——描述性统计。事实上,80%的商业分析问题, ...
2026-04-20在数字化时代,数据已成为企业决策的核心驱动力,数据分析与数据挖掘作为解锁数据价值的关键手段,广泛应用于互联网、金融、医疗 ...
2026-04-17在数据处理、后端开发、报表生成与自动化脚本中,将 SQL 查询结果转换为字符串是一项高频且实用的操作。无论是拼接多行数据为逗 ...
2026-04-17面对一份上万行的销售明细表,要快速回答“哪个地区卖得最好”“哪款产品增长最快”“不同客户类型的购买力如何”——这些看似复 ...
2026-04-17数据分析师一天的工作,80% 的时间围绕表格结构数据展开。从一张销售明细表到一份完整的分析报告,表格结构数据贯穿始终。但你真 ...
2026-04-16在机器学习无监督学习领域,Kmeans聚类因其原理简洁、计算高效、可扩展性强的优势,成为数据聚类任务中的主流算法,广泛应用于用 ...
2026-04-16