性感的数据可视化 —— 精讲桑基图、气泡图、南丁格尔玫瑰图

简介: 文章主要为大家介绍三个可视化故事,和他们使用的三个重要的可视化组件:桑基图、气泡图、南丁格尔玫瑰图。

前言:更多关于数智化转型、数据中台内容可扫码加群一起探讨
668d7f5941782665ed1f41529db3eb677f4b9379.png
阿里云数据中台官网 https://dp.alibaba.com/index


(作者:常成)

2019年的“凯度信息之美奖”揭晓了,有很多很有意思的信息可视化作品。很多作品看到的时候都被感动到,数据/信息不再是冷冰冰的,而是立体的,通过可视化可以让人们更清晰的看到和感受到作者想表达的信息,比文字更加直接。选择了合适的数据可视化组件,就会有魔力,让你想传达的信息变得生动起来。

 

这里介绍三个可视化作品和故事,和他们使用的三个重要的可视化组件:桑基图、气泡图、南丁格尔玫瑰图。

1. “凯度信息之美奖”的人道主义类金奖 - 《看不见的罪行:我们是否让性侵受害者失望了?》

22.png

作者研究了很多性暴力事件,采访了很多性侵幸存者,通过「桑基图」来展示性暴力事件有多少被起诉,为什么社会系统没能为受害者伸张正义。这每一个数字背后都是受到伤害的人们。

 

桑基图的使用场景
桑基图(Sankey diagram),即桑基能量分流图,也叫桑基能量平衡图。因1898年Matthew Henry Phineas Riall Sankey绘制的“蒸汽机的能源效率图”而闻名,此后便以其名字命名为“桑基图”。

使用桑基图能够很好的表达数据的流动,可以非常明显的看到整体数据和各个阶段的流向。

上面那个例子中一方面可以很清晰地看到向警方报告的性暴力事件,最终都流向了什么样的结果。另一方面,最初报告的事件数和最终判决的对比也是如此的强烈。

因为能够非常直观的表达出数据的流向,并且简单易懂,桑基图的应用场景越来越多,也被大量应用于媒体中。另外在网站/APP的流量/用户行为数据分析中也得到了大量的应用,分析用户从哪些落地页进入,又因为什么页面跳出,在网站中如何流动。比如Google Analytics中的页面流/事件流。

 

2.  汉斯·罗斯林告诉我们的《事实》

“你觉得数据无聊是因为这不是你想知道的,或者说你并没有意识到这些数据和真实世界的联系。” —— 汉斯·罗斯林
5.jpg

统计学家汉斯·罗斯林在大学授课的时候发现大家对这个世界有很多误解,所以他将后半生都致力于将真实信息传达给世界。在他最出名的一次演讲中他用气泡图,用 12 万个数据解释 200 个国家 200 年的发展。

 

这个气泡图中每个气泡代表一个国家,横轴是各个人均收入,纵轴是寿命,气泡大小表示人口,那两个大红点分别是中国和印度。

可以看出来各个国家在过去200年都逐渐往右上角移动,更高的收入,更高的寿命,世界在一点点的变好。

 

气泡图的使用场景

气泡图可以用于展示三个度量之间的相关关系,或者同时呈现三维数据。

比如罗斯林的这个图,同时向我们展示了每个国家的:人均收入、寿命、人口。同时气泡基本分布在一条斜线上,人均收入和寿命有一定的相关性。

 

  1. 南丁格尔用「玫瑰图」挽救了千万人的生命
    3.jpg

这是一张19世纪50年代的图表,当时英国、法国、土耳其和俄国正在进行克里米亚战争。南丁格尔主动申请,自愿担任战地护士。南丁格尔发现改善医疗环境可以降低死亡率,所以做了这个图,向政府说明应该改善战地医院的条件来拯救更多年轻的生命。右侧的玫瑰图表示1854 年 4 月至 1955 年 3 月每月的死亡率,每月死亡率都非常高,高达42%。左侧的玫瑰图表示1955年3月卫生委员会改善了卫生环境之后,死亡率得到了大幅下降,戏剧性地降至 2.5%。另外图中灰色区域表示糟糕的医疗环境的感染导致的死亡,可以看到大部分的伤亡并非直接来自战争,而是因为医疗环境。

左右2个图的大小对比出卫生环境改善前后死亡率的变化,各种颜色扇区的面积强烈对比出环境对死亡的影响。

这样强烈的对比让政府相关官员了解到:改善医院的医疗状况可以显著的降低英军的死亡率,最终挽救了千万人的生命。这种新型的图表也由此得名,因为外形很像一朵绽放的玫瑰,这种图表也被称为“南丁格尔玫瑰图”。

 

南丁格尔玫瑰图的使用场景

这种图表适合用于对比各类别的数据,而相比柱图/条形图等图表类型来说,南丁格尔玫瑰图能够放大数据差异。因为它使用扇区半径来表示数据的大小,半径和面积的关系是平方的关系,用户直觉上会通过面积来感知差异,所以它会将数据的比例大小夸大。这种放大数据差异的效果尤其适合对比大小相近的数值,或者像南丁格尔一样就是希望突出数据差异的场景。

当然在使用这个图表的时候需要注意,因为它夸大了数据的差异,比如两个类别数据原本差10倍,用这个图表就会给人一种差100倍的感觉。所以如果希望客观的展示数据,还是建议使用柱图等图表类型。
 

这里想告诉小伙伴们,使用Quick BI,可以快速制作桑基图、气泡图、玫瑰图哦。
(**智能数据分析与可视化-Quick BI:专为云上用户和企业量身打造的新一代自助式智能BI服务平台,简单易用的可视化操作和灵活高效的多维分析能力,让精细化数据洞察为商业决策保驾护航。
中国唯一进入Gartner魔力象限BI产品,此次联合钉钉协同升级,“随时随地、智能决策”。**)
在Quick BI上,可以通过简单的勾勾选选就能做出桑基图、气泡图、玫瑰图。

快来使用试试哦,通过数据可视化,让你的汇报、故事更性感吧~

PS:
凯度信息之美奖:  https://www.informationisbeautifulawards.com/news/485-information-is-beautiful-awards-2019-the-winners
汉斯·罗斯林用前所未有的好方法诠释数字统计:https://www.ted.com/talks/hans_rosling_the_best_stats_you_ve_ever_seen?language=zh-cn
汉斯·罗斯林的非营利机构: https://www.gapminder.org/


数据中台是企业数智化的新基建,阿里巴巴认为数据中台是集方法论、工具、组织于一体的,“快”、“准”、“全”、“统”、“通”的智能大数据体系。目前正通过阿里云数据中台解决方案对外输出,包括零售、金融、互联网等行业,其中核心产品有:

数据中台官网 https://dp.alibaba.com
数据中台钉钉群二维码2.jpg


相关实践学习
AnalyticDB PostgreSQL 企业智能数据中台:一站式管理数据服务资产
企业在数据仓库之上可构建丰富的数据服务用以支持数据应用及业务场景;ADB PG推出全新企业智能数据平台,用以帮助用户一站式的管理企业数据服务资产,包括创建, 管理,探索, 监控等; 助力企业在现有平台之上快速构建起数据服务资产体系
相关文章
|
数据采集 监控 机器人
User-Agent 即用户代理
User-Agent 即用户代理
1181 2
|
XML 编解码 前端开发
【web组件库系列】封装自己的字体图标库
【web组件库系列】封装自己的字体图标库
646 0
|
7月前
|
编解码 数据可视化 图形学
Blender三轴旋转全解析:从立方体到猴子墙的创意实践
本文详解Blender三轴旋转核心技巧,涵盖立方体变形、猴子墙阵列、螺旋矩阵三大实战案例,结合Python脚本实现精准旋转、批量生成与随机化效果,并解析欧拉角、坐标系、驱动器及性能优化方案,助力游戏建模高效创作。(239字)
1048 1
|
存储 Ubuntu 网络协议
轻松搭建Nextcloud私有云盘并实现远程访问【内网穿透】
轻松搭建Nextcloud私有云盘并实现远程访问【内网穿透】
1669 0
|
存储 SQL 分布式计算
一文彻底搞懂Hive的数据存储与压缩
怎样弄清Hive的数据存储与压缩呢,以下回答告诉你。
1380 0
一文彻底搞懂Hive的数据存储与压缩
|
测试技术 微服务 负载均衡
微服务部署:蓝绿部署、滚动部署、灰度发布、金丝雀发布
在项目迭代的过程中,不可避免需要”上线“。上线对应着部署,或者重新部署;部署对应着修改;修改则意味着风险。 目前有很多用于部署的技术,有的简单,有的复杂;有的得停机,有的不需要停机即可完成部署。
3599 0
|
机器学习/深度学习 搜索推荐 算法
“个性化推荐API:动态匹配用户需求,提高客单价”
个性化推荐API通过分析用户行为数据,实时生成定制化推荐,核心价值在于动态匹配需求、提升转化率与客单价。其逻辑基于协同过滤与深度学习算法,结合库存和营销策略优化推荐结果。技术落地需完成数据埋点、算法配置及AB测试,效果评估则关注CTR、转化率等指标。除电商外,该API还适用于内容平台、旅游预订及B2B采购等领域,助力企业扩展商业边界并实现收入增长。
|
消息中间件 缓存 负载均衡
php怎么解决高并发的问题
在实际应用中,应根据具体需求和应用场景,选择合适的优化方案,并进行持续监控和优化,确保系统的高效稳定运行。
675 6
|
运维 NoSQL Java
后端架构演进:微服务架构的优缺点与实战案例分析
【10月更文挑战第28天】本文探讨了微服务架构与单体架构的优缺点,并通过实战案例分析了微服务架构在实际应用中的表现。微服务架构具有高内聚、低耦合、独立部署等优势,但也面临分布式系统的复杂性和较高的运维成本。通过某电商平台的实际案例,展示了微服务架构在提升系统性能和团队协作效率方面的显著效果,同时也指出了其带来的挑战。
862 4
|
机器学习/深度学习 算法 物联网
大模型进阶微调篇(一):以定制化3B模型为例,各种微调方法对比-选LoRA还是PPO,所需显存内存资源为多少?
本文介绍了两种大模型微调方法——LoRA(低秩适应)和PPO(近端策略优化)。LoRA通过引入低秩矩阵微调部分权重,适合资源受限环境,具有资源节省和训练速度快的优势,适用于监督学习和简单交互场景。PPO基于策略优化,适合需要用户交互反馈的场景,能够适应复杂反馈并动态调整策略,适用于强化学习和复杂用户交互。文章还对比了两者的资源消耗和适用数据规模,帮助读者根据具体需求选择最合适的微调策略。
5219 5