一般大家在学习python机器学习的时候,用的最多的可视化的包就是matplot和seaborn, 这2个可视化的优点在于门槛低,代码容易理解,并且容易上手。唯一的可能的缺点就是画出来的图不能交互,简单来说就是matplot和seaborn给出的就是一个图片,当将鼠标放到图上的时候,不会显示出图中具体的数字是多少,而使用plotly之后,可以将图片放大缩小,可以显示与不显示不同类别数据,等等。并且更加方便的是,这个图可以嵌入到html里面,可以直接放到网页上面。我们话不多说,用matplot和plotly来展示相同的数据。
当前使用的数据是股票数据,使用pandas_datareader中的yahoo的API下载一些股票数据,将下载阿里巴巴,苹果,微软,和IBM的每天最高价,并且做出一个图出来。
首先我们作出一个matplot的图出来,由于DataFrame自带了plot的功能,我们就可以直接用.plot()的方法输出图片

然后下看我们用plotly给出的效果,代码部分稍后给出。
我们从这个gif中可以明显的看出来plotly的图片有很好的交互,并且如果将该文件下载为html文件后,这种图也会被嵌入在html文件里面,并且也会保持这种交互的功能。
那什么时候我们用matplot还是plotly呢?个人认为,对于机器学习的结果来说,使用matplot来做模型的结果的检测就足够了,比如说查看是否过拟合,AUCROC图。而plotly更加适合做报表系统,因为对于报表来说,不仅要展示图的大体信息,比如上图中每个股票的趋势,而且更加的是这个图是否能够体现出更多的细节,从而可以让决策者发现比较重要的信息。那在这种需要下,plotly就是一种比较不错的选择。
在市场上,还有一种很火的软件叫echart,那为什么我们不介绍echart而介绍python plotly呢,那是因为echart是用java来写的,并且写法比较复杂,需要重新学习java语言才能画出类似的这种可交互的图出来。但是对于plotly来说的话,我们直接可以用python来写,并且代码量比java的少很多,我们可以直接将我们熟悉的python list, numpy, pandas放进去就可以画图,并且给出的效果和echart的图一摸一样。
另外要提一点的是python plotly也是可以用来做动图的,我们后面会给大家介绍一种用plolty做出来的用于展示Kmeans算法过程的动图。在这个动图中我们则可以很容易的来理解Kmeans的迭代过程。
安装plotly和其他的安装python包的程序一样,直接在终端打入以下:
pip install -i https://pypi.tuna.tsinghua.edu.cn/simple plotly
这里为了防止下载速度过慢,加上了清华源的地址。下载好了plotly之后,如果需要使用plotly的话则需要有2种模式,一种是线上,一种是线下。如果是线上的话,则需要注册一个账号密码,然后在notebook里创造的图将会同步到plotly的个人云盘里面去。但是这种操作不是很好,因为一般一个人最多线上存20张图,之后再做图就会报错。所以我们这里直接介绍offline的模式,也就是线下的模式,这种模式没有限制。
官网在https://plot.ly/python/, 有的时候需要注意,由于某墙的原因,这个网站会加载的非常慢。这个网页里详细的介绍了各种图的制作,我们这会简单的介绍一下scatter plot和给出一个3D图的例子。
注意在当前markdown文档里,plotly给出的图不能交互,在ipynb和html里面可以。
首先需要import下一线离线的关于plotly的包。
我们就拿刚才我们下载的IBM的股票数据来画图。首先我们看下数据是什么样的。我们的数据主要由2部分组成,一个是时间,另一个是每个时间所对应的值。
所以对于这种数据来说,如果我们想给它画出一个图出来的话,需要一个x轴和y轴。所以这里的话需要将时间作为x轴,数据作为y轴。
对于plotly来说,我们需要x和y的数据全部放入一个叫Scatter的类里面去,并且外面需要用list作为容纳Scatter的一个容器。
当data创建好之后,则需要开始创建框架Layout,也就是x轴,y轴,标题,模版等信息,框架创建出来后,可以用来存放刚才写好的data
xaxis = {'title' : 'Date'}, #x轴的标题 yaxis = {'title' : 'High'}, #y轴的标题 template = 'plotly_white' #背景模版,这里是指背景为白色 )
当layout创建好之后,则需要将data和layout放入Figure这个图里面即可
fig = go.Figure(data = data, layout = layout) fig.show()
这里我们看到了我们只是把各种的点给画出来了,但是我们面对的数据是时间序列数据,数据不是杂乱无序的。那我们则需要更改下data里的mode值。
那这个时候我们的图就做出来。现在有个问题是我这里的图只是展示出了一个股票,多个股票可以吗?可以的。当前我们在写data的时候,可以看出它其实是一个list,当前我们的data list里面只有一个元素,这个元素就是我们用Scatter创建的一个类,里面记录的IBM的数据。所以我们可以在这个list里面放入多个Scatter,记录不同的股票数据

这样子就可以用来比较了。但是呢我们这里如果有多个数据需要放入的话,在data里一行一行的加入股票数据,不方便也不美观,可以采用列表解析式。列表解析式[i for i in result_df.columns]里,每个i就是每个股票的名字,用result_df[i]就可以把每个股票都取出来放入一个go.Scatter()里面,并且name = i,则可以了。并且列表解析给出结果已经是一个list了,所以直接赋值给data进行做图。

这里我们的图的代码不来详细的介绍,这个在这里展示出来,给大家看一下plotly做出的3D图的效果。这里的例子是参考官网的例子。对于这种3D-surface的图来说,可以用来很好的展示机器学习中梯度下降的内容。
网址链接: https://plot.ly/python/3d-surface-plots/
plotly这个可视化工具,你可还喜欢?
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析在当今信息时代发挥着重要作用。单因素方差分析(One-Way ANOVA)是一种关键的统计方法,用于比较三个或更多独立样本组 ...
2025-04-25CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-25在当今数字化时代,数据分析师的重要性与日俱增。但许多人在踏上这条职业道路时,往往充满疑惑: 如何成为一名数据分析师?成为 ...
2025-04-24以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《刘静:10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda ...
2025-04-23大咖简介: 刘凯,CDA大咖汇特邀讲师,DAMA中国分会理事,香港金管局特聘数据管理专家,拥有丰富的行业经验。本文将从数据要素 ...
2025-04-22CDA持证人简介 刘伟,美国 NAU 大学计算机信息技术硕士, CDA数据分析师三级持证人,现任职于江苏宝应农商银行数据治理岗。 学 ...
2025-04-21持证人简介:贺渲雯 ,CDA 数据分析师一级持证人,互联网行业数据分析师 今天我将为大家带来一个关于用户私域用户质量数据分析 ...
2025-04-18一、CDA持证人介绍 在数字化浪潮席卷商业领域的当下,数据分析已成为企业发展的关键驱动力。为助力大家深入了解数据分析在电商行 ...
2025-04-17CDA持证人简介:居瑜 ,CDA一级持证人,国企财务经理,13年财务管理运营经验,在数据分析实践方面积累了丰富的行业经验。 一、 ...
2025-04-16持证人简介: CDA持证人刘凌峰,CDA L1持证人,微软认证讲师(MCT)金山办公最有价值专家(KVP),工信部高级项目管理师,拥有 ...
2025-04-15持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。在实际生活中,我们可能会 ...
2025-04-14在 Python 编程学习与实践中,Anaconda 是一款极为重要的工具。它作为一个开源的 Python 发行版本,集成了众多常用的科学计算库 ...
2025-04-14随着大数据时代的深入发展,数据运营成为企业不可或缺的岗位之一。这个职位的核心是通过收集、整理和分析数据,帮助企业做出科 ...
2025-04-11持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。 本次分享我将以教培行业为 ...
2025-04-11近日《2025中国城市长租市场发展蓝皮书》(下称《蓝皮书》)正式发布。《蓝皮书》指出,当前我国城市住房正经历从“增量扩张”向 ...
2025-04-10在数字化时代的浪潮中,数据已经成为企业决策和运营的核心。每一位客户,每一次交易,都承载着丰富的信息和价值。 如何在海量客 ...
2025-04-09数据是数字化的基础。随着工业4.0的推进,企业生产运作过程中的在线数据变得更加丰富;而互联网、新零售等C端应用的丰富多彩,产 ...
2025-04-094月7日,美国关税政策对全球金融市场的冲击仍在肆虐,周一亚市早盘,美股股指、原油期货、加密货币、贵金属等资产齐齐重挫,市场 ...
2025-04-08背景 3月26日,科技圈迎来一则重磅消息,苹果公司宣布向浙江大学捐赠 3000 万元人民币,用于支持编程教育。 这一举措并非偶然, ...
2025-04-07在当今数据驱动的时代,数据分析能力备受青睐,数据分析能力频繁出现在岗位需求的描述中,不分岗位的任职要求中,会特意标出“熟 ...
2025-04-03