京公网安备 11010802034615号
经营许可证编号:京B2-20210330
一般大家在学习python机器学习的时候,用的最多的可视化的包就是matplot和seaborn, 这2个可视化的优点在于门槛低,代码容易理解,并且容易上手。唯一的可能的缺点就是画出来的图不能交互,简单来说就是matplot和seaborn给出的就是一个图片,当将鼠标放到图上的时候,不会显示出图中具体的数字是多少,而使用plotly之后,可以将图片放大缩小,可以显示与不显示不同类别数据,等等。并且更加方便的是,这个图可以嵌入到html里面,可以直接放到网页上面。我们话不多说,用matplot和plotly来展示相同的数据。
当前使用的数据是股票数据,使用pandas_datareader中的yahoo的API下载一些股票数据,将下载阿里巴巴,苹果,微软,和IBM的每天最高价,并且做出一个图出来。
首先我们作出一个matplot的图出来,由于DataFrame自带了plot的功能,我们就可以直接用.plot()的方法输出图片

然后下看我们用plotly给出的效果,代码部分稍后给出。
我们从这个gif中可以明显的看出来plotly的图片有很好的交互,并且如果将该文件下载为html文件后,这种图也会被嵌入在html文件里面,并且也会保持这种交互的功能。
那什么时候我们用matplot还是plotly呢?个人认为,对于机器学习的结果来说,使用matplot来做模型的结果的检测就足够了,比如说查看是否过拟合,AUCROC图。而plotly更加适合做报表系统,因为对于报表来说,不仅要展示图的大体信息,比如上图中每个股票的趋势,而且更加的是这个图是否能够体现出更多的细节,从而可以让决策者发现比较重要的信息。那在这种需要下,plotly就是一种比较不错的选择。
在市场上,还有一种很火的软件叫echart,那为什么我们不介绍echart而介绍python plotly呢,那是因为echart是用java来写的,并且写法比较复杂,需要重新学习java语言才能画出类似的这种可交互的图出来。但是对于plotly来说的话,我们直接可以用python来写,并且代码量比java的少很多,我们可以直接将我们熟悉的python list, numpy, pandas放进去就可以画图,并且给出的效果和echart的图一摸一样。
另外要提一点的是python plotly也是可以用来做动图的,我们后面会给大家介绍一种用plolty做出来的用于展示Kmeans算法过程的动图。在这个动图中我们则可以很容易的来理解Kmeans的迭代过程。
安装plotly和其他的安装python包的程序一样,直接在终端打入以下:
pip install -i https://pypi.tuna.tsinghua.edu.cn/simple plotly
这里为了防止下载速度过慢,加上了清华源的地址。下载好了plotly之后,如果需要使用plotly的话则需要有2种模式,一种是线上,一种是线下。如果是线上的话,则需要注册一个账号密码,然后在notebook里创造的图将会同步到plotly的个人云盘里面去。但是这种操作不是很好,因为一般一个人最多线上存20张图,之后再做图就会报错。所以我们这里直接介绍offline的模式,也就是线下的模式,这种模式没有限制。
官网在https://plot.ly/python/, 有的时候需要注意,由于某墙的原因,这个网站会加载的非常慢。这个网页里详细的介绍了各种图的制作,我们这会简单的介绍一下scatter plot和给出一个3D图的例子。
注意在当前markdown文档里,plotly给出的图不能交互,在ipynb和html里面可以。
首先需要import下一线离线的关于plotly的包。
我们就拿刚才我们下载的IBM的股票数据来画图。首先我们看下数据是什么样的。我们的数据主要由2部分组成,一个是时间,另一个是每个时间所对应的值。
所以对于这种数据来说,如果我们想给它画出一个图出来的话,需要一个x轴和y轴。所以这里的话需要将时间作为x轴,数据作为y轴。
对于plotly来说,我们需要x和y的数据全部放入一个叫Scatter的类里面去,并且外面需要用list作为容纳Scatter的一个容器。
当data创建好之后,则需要开始创建框架Layout,也就是x轴,y轴,标题,模版等信息,框架创建出来后,可以用来存放刚才写好的data
xaxis = {'title' : 'Date'}, #x轴的标题 yaxis = {'title' : 'High'}, #y轴的标题 template = 'plotly_white' #背景模版,这里是指背景为白色 )
当layout创建好之后,则需要将data和layout放入Figure这个图里面即可
fig = go.Figure(data = data, layout = layout) fig.show()
这里我们看到了我们只是把各种的点给画出来了,但是我们面对的数据是时间序列数据,数据不是杂乱无序的。那我们则需要更改下data里的mode值。
那这个时候我们的图就做出来。现在有个问题是我这里的图只是展示出了一个股票,多个股票可以吗?可以的。当前我们在写data的时候,可以看出它其实是一个list,当前我们的data list里面只有一个元素,这个元素就是我们用Scatter创建的一个类,里面记录的IBM的数据。所以我们可以在这个list里面放入多个Scatter,记录不同的股票数据

这样子就可以用来比较了。但是呢我们这里如果有多个数据需要放入的话,在data里一行一行的加入股票数据,不方便也不美观,可以采用列表解析式。列表解析式[i for i in result_df.columns]里,每个i就是每个股票的名字,用result_df[i]就可以把每个股票都取出来放入一个go.Scatter()里面,并且name = i,则可以了。并且列表解析给出结果已经是一个list了,所以直接赋值给data进行做图。

这里我们的图的代码不来详细的介绍,这个在这里展示出来,给大家看一下plotly做出的3D图的效果。这里的例子是参考官网的例子。对于这种3D-surface的图来说,可以用来很好的展示机器学习中梯度下降的内容。
网址链接: https://plot.ly/python/3d-surface-plots/
plotly这个可视化工具,你可还喜欢?
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据分析、质量控制、科研实验等场景中,数据波动性(离散程度)的精准衡量是判断数据可靠性、稳定性的核心环节。标准差(Stan ...
2026-01-29在数据分析、质量检测、科研实验等领域,判断数据间是否存在本质差异是核心需求,而t检验、F检验是实现这一目标的经典统计方法。 ...
2026-01-29统计制图(数据可视化)是数据分析的核心呈现载体,它将抽象的数据转化为直观的图表、图形,让数据规律、业务差异与潜在问题一目 ...
2026-01-29箱线图(Box Plot)作为数据分布可视化的核心工具,能清晰呈现数据的中位数、四分位数、异常值等关键统计特征,广泛应用于数据分 ...
2026-01-28在回归分析、机器学习建模等数据分析场景中,多重共线性是高频数据问题——当多个自变量间存在较强的线性关联时,会导致模型系数 ...
2026-01-28数据分析的价值落地,离不开科学方法的支撑。六种核心分析方法——描述性分析、诊断性分析、预测性分析、规范性分析、对比分析、 ...
2026-01-28在机器学习与数据分析领域,特征是连接数据与模型的核心载体,而特征重要性分析则是挖掘数据价值、优化模型性能、赋能业务决策的 ...
2026-01-27关联分析是数据挖掘领域中挖掘数据间潜在关联关系的经典方法,广泛应用于零售购物篮分析、电商推荐、用户行为路径挖掘等场景。而 ...
2026-01-27数据分析的基础范式,是支撑数据工作从“零散操作”走向“标准化落地”的核心方法论框架,它定义了数据分析的核心逻辑、流程与目 ...
2026-01-27在数据分析、后端开发、业务运维等工作中,SQL语句是操作数据库的核心工具。面对复杂的表结构、多表关联逻辑及灵活的查询需求, ...
2026-01-26支持向量机(SVM)作为机器学习中经典的分类算法,凭借其在小样本、高维数据场景下的优异泛化能力,被广泛应用于图像识别、文本 ...
2026-01-26在数字化浪潮下,数据分析已成为企业决策的核心支撑,而CDA数据分析师作为标准化、专业化的数据人才代表,正逐步成为连接数据资 ...
2026-01-26数据分析的核心价值在于用数据驱动决策,而指标作为数据的“载体”,其选取的合理性直接决定分析结果的有效性。选对指标能精准定 ...
2026-01-23在MySQL查询编写中,我们习惯按“SELECT → FROM → WHERE → ORDER BY”的语法顺序组织语句,直觉上认为代码顺序即执行顺序。但 ...
2026-01-23数字化转型已从企业“可选项”升级为“必答题”,其核心本质是通过数据驱动业务重构、流程优化与模式创新,实现从传统运营向智能 ...
2026-01-23CDA持证人已遍布在世界范围各行各业,包括世界500强企业、顶尖科技独角兽、大型金融机构、国企事业单位、国家行政机关等等,“CDA数据分析师”人才队伍遵守着CDA职业道德准则,发挥着专业技能,已成为支撑科技发展的核心力量。 ...
2026-01-22在数字化时代,企业积累的海量数据如同散落的珍珠,而数据模型就是串联这些珍珠的线——它并非简单的数据集合,而是对现实业务场 ...
2026-01-22在数字化运营场景中,用户每一次点击、浏览、交互都构成了行为轨迹,这些轨迹交织成海量的用户行为路径。但并非所有路径都具备业 ...
2026-01-22在数字化时代,企业数据资产的价值持续攀升,数据安全已从“合规底线”升级为“生存红线”。企业数据安全管理方法论以“战略引领 ...
2026-01-22在SQL数据分析与业务查询中,日期数据是高频处理对象——订单创建时间、用户注册日期、数据统计周期等场景,都需对日期进行格式 ...
2026-01-21