数据可视化 真正可以遵循的制图技巧
可视化有许多“规则”。有的是实际的规则,有的则是帮助你做出选择的建议。如果是出于数据的要求,而且你也知道该怎么做,那么许多实际的规则也不必遵守。
但是,的确有一些规则不应该违背。这些规则通常是用于一些特定种类、几乎只能用特定方式阅读的图表。当这些规则被打破,阅读过程中,数据有可能被误读。这会有点棘手。
条形图的基线必须从零开始
条形图依赖长度来呈现数据。短的条块代表较低的值,长一些的则表示较高的值。条形图的原理就是通过比较条块的长度来比较值的大小。
当基线被改变了,视觉效果也就扭曲了。
举例来说,请看上图。左边第一幅条形图比较了两个值:50和100,它有一条并且它有一条以零为起点的基线。很好。代表数值100的条块长度正好是数值50的两倍长,为100正好也是50的两倍大小。
但当你把基线变为一个更高的、非零的值时,第一个条形的长度变短了,而另外一个条形的长度却没有变。此时值为100的条形不再是值为50的条形的两倍长。以此类推,当最后左边代表数值50的条形彻底消失了,意味着100无限地大于50了。
条形图的基线必须从零开始。
例:这张条形图是经福克斯新闻准许使用的。
3月31日目标的值为7,066,000,比6,000,000高17.8%,然而第二个条形几乎是第一个条形长度的三倍。
有人也许会反驳说,这张图的重点在于两个值的差而非这两个值本身。即便如此,用条形图来表示本身就是一个错误的选择。使用时间序列来呈现月累积数也许会更好。
不要过分热衷于饼图
有些人认为,应该完全避免饼图。他们也许是对的,也许又不是。有些人也许会说,使用饼图完全是一种不可原谅的错误。对此,我不同意。不管怎样,事实情况是人们仍然使用饼图,所以我们至少可以争取正确地使用它们。
避免过度切割饼图,否则最终对它的阅读将难以为继。
那么多少是“太多”?这是一个判断力的问题。不过,如果已经很难从图中看出其中一块扇形是另一块两倍大,或者好几个较小的扇形区域看起来差不多大时,在扇形切割上面就该收手了。此时可以考虑把较小的类目归入一个更大的:“其他”。圆环图也是一样。
同时也考虑一下用其他种类的图表来表示比例。
不要太依赖于饼图。
例:这张饼图来自维基百科,它展示了国家的不同区域。
左边这张饼图中已经切割了许多块,但旁边另分离出一张饼图,显示了左图中看不清楚的更小国家的情况,以此来提供更多的信息。有许多方式可以展示这组数据,比如树状图、按照数据比例制作的图标,或者就用普通的地图。单薄的饼图只适用于显示只有几组值的数据。
尊重部分所占整体的比例
相较于呈现数值,有些图更着重于表现部分与整体的关系,它们表现的数据是部分所占整体比例。比如,堆积式条形图,堆积区域图,树状图,马赛克图,圆环图以及饼图。在这些图表中,每一个部分都表示一个独立的、不重叠的比例。
关于这一条,最常见的错误发生在调查问题允许多选时。比如说:“你上周使用了哪一种交通工具?可以多选。”这样的话,在人们多选的问题上就会出现比例的重叠,不同选项的百分比之和大于一。为了避免这种情况,你不能直接把比例做成统计图。
例:这张饼图来自福克斯新闻下属机构,它表现了三个不属于同一个整体的百分比。
每一个值都是一个单独的整体,因此在这一例中,用三个堆积式条块(或普通的条块)会更直观地表现每个值的比例。
展示数据
让读者看到数据,这是可视化的重点。如果数据的呈现不够清晰,就违背了做图表的初衷。这常常是因为一张图里的数据太多,于是读者的兴趣就被分散了。
这是一个经典的“绘图过度”的问题,相关的研究有很多。但是对于基本的图表,也有一些简单的解决方式。
首先是可以改变符号的大小,这样上图中的小圆点(或者是其他的符号)就不会占据太多空间。为了让数据直观清晰,主要要增加空白。
调节透明度,多层次的图案就不会被覆盖。
通过取样或者把对数据进行分类的方式,把总体分成几个更小的子群。从中,你可以采取小而多的方式,这样每张表里的信息就会少一些。
数据进行再统计及分门别类。
总而言之,更好地呈现数据。
例:这张图展示了金州勇士队在2008-09赛季的每个投篮。
这张图最终形成了一个球场的形状,并得出了对于球员们投篮最多的地点的一个小结论——近框,中距离,以及三分球。但是它们之间的差距是很小的,读者并不能看清真正量级上的差距。
数据聚合法将有助于解决此类问题。
解释编码
通过一定的形状、颜色和几何图形的结合,将数据呈现出来。为了让读者能读清楚,图表设计者就要把这些图形解码回数据值。经典的例子是没有标注的坐标轴。
有时编码不需要解释。比如说,读者也许知道怎样读条形图,就不必解释条的长度表示的是值的大小了。但是设计者的确应该解释数据,也就是图表的单位和主题。
所以标明坐标轴代表的含义。要给读者提供线索或图例,解释图表。
例:这个错误标注的图表来自温尼伯太阳报:
我们要是能知道这是统计关于什么的问题就好了。
大功告成
搞定了。最后一件事就是确保你没有违反最基础的可视化规则——这都是关于理解数据转换可视化图形的过程。如果能弄明白怎数据是如何转换成几何图形的,你就可以创作自己的可视化作品了。但对于特定的几种只能用特定方式来读取的图表,是没有什么改变的余地的。
总之,一定要学会把数据转换成可视化图形。然后真正理解可视化制图中“规则”和“建议”的不同之处。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
数据分析在当今信息时代发挥着重要作用。单因素方差分析(One-Way ANOVA)是一种关键的统计方法,用于比较三个或更多独立样本组 ...
2025-04-25CDA持证人简介: 居瑜 ,CDA一级持证人国企财务经理,13年财务管理运营经验,在数据分析就业和实践经验方面有着丰富的积累和经 ...
2025-04-25在当今数字化时代,数据分析师的重要性与日俱增。但许多人在踏上这条职业道路时,往往充满疑惑: 如何成为一名数据分析师?成为 ...
2025-04-24以下的文章内容来源于刘静老师的专栏,如果您想阅读专栏《刘静:10大业务分析模型突破业务瓶颈》,点击下方链接 https://edu.cda ...
2025-04-23大咖简介: 刘凯,CDA大咖汇特邀讲师,DAMA中国分会理事,香港金管局特聘数据管理专家,拥有丰富的行业经验。本文将从数据要素 ...
2025-04-22CDA持证人简介 刘伟,美国 NAU 大学计算机信息技术硕士, CDA数据分析师三级持证人,现任职于江苏宝应农商银行数据治理岗。 学 ...
2025-04-21持证人简介:贺渲雯 ,CDA 数据分析师一级持证人,互联网行业数据分析师 今天我将为大家带来一个关于用户私域用户质量数据分析 ...
2025-04-18一、CDA持证人介绍 在数字化浪潮席卷商业领域的当下,数据分析已成为企业发展的关键驱动力。为助力大家深入了解数据分析在电商行 ...
2025-04-17CDA持证人简介:居瑜 ,CDA一级持证人,国企财务经理,13年财务管理运营经验,在数据分析实践方面积累了丰富的行业经验。 一、 ...
2025-04-16持证人简介: CDA持证人刘凌峰,CDA L1持证人,微软认证讲师(MCT)金山办公最有价值专家(KVP),工信部高级项目管理师,拥有 ...
2025-04-15持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。在实际生活中,我们可能会 ...
2025-04-14在 Python 编程学习与实践中,Anaconda 是一款极为重要的工具。它作为一个开源的 Python 发行版本,集成了众多常用的科学计算库 ...
2025-04-14随着大数据时代的深入发展,数据运营成为企业不可或缺的岗位之一。这个职位的核心是通过收集、整理和分析数据,帮助企业做出科 ...
2025-04-11持证人简介:CDA持证人黄葛英,ICF国际教练联盟认证教练,前字节跳动销售主管,拥有丰富的行业经验。 本次分享我将以教培行业为 ...
2025-04-11近日《2025中国城市长租市场发展蓝皮书》(下称《蓝皮书》)正式发布。《蓝皮书》指出,当前我国城市住房正经历从“增量扩张”向 ...
2025-04-10在数字化时代的浪潮中,数据已经成为企业决策和运营的核心。每一位客户,每一次交易,都承载着丰富的信息和价值。 如何在海量客 ...
2025-04-09数据是数字化的基础。随着工业4.0的推进,企业生产运作过程中的在线数据变得更加丰富;而互联网、新零售等C端应用的丰富多彩,产 ...
2025-04-094月7日,美国关税政策对全球金融市场的冲击仍在肆虐,周一亚市早盘,美股股指、原油期货、加密货币、贵金属等资产齐齐重挫,市场 ...
2025-04-08背景 3月26日,科技圈迎来一则重磅消息,苹果公司宣布向浙江大学捐赠 3000 万元人民币,用于支持编程教育。 这一举措并非偶然, ...
2025-04-07在当今数据驱动的时代,数据分析能力备受青睐,数据分析能力频繁出现在岗位需求的描述中,不分岗位的任职要求中,会特意标出“熟 ...
2025-04-03