百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 热门文章 > 正文

R语言绘制桑基图,做好了也可以出大片!

bigegpt 2024-09-27 00:36 5 浏览

背景介绍

什么样的数据可以用桑基图?比如下面的,你可以理解为有大于等于2列的文本标签以及1列统计数值就可以。

如果只有大于两组的文本标签,也是可以的。

桑基图的核心组成部分包括边、流量和节点,这里的边表示流动数据,流量则对应流动数据的确切数值,而节点则代表不同的类别。边的宽度根据流量成比例地呈现,宽度越大,数值也越高。

软件介绍

软件名称:R 4.2.2

教程介绍

1.下面是来自于官网的示例,输入?geom_alluvium即可查看。首先下载和加载该R包

library(ggplot2)
library(ggalluvial)

2.输入?geom_alluvium,就可以查看该函数的功能和参数

3.首先画一个基础的桑基图

ggplot(as.data.frame(Titanic),
       
       # 定义图形的绘制
       aes(y = Freq,
           axis1 = Class, axis2 = Sex, axis3 = Age,
           fill = Survived)) +
  geom_alluvium() +
  scale_x_discrete(limits = c("Class", "Sex", "Age"))

4.我们继续给每列的不同标签加上方框以及对应的文字

ggplot(as.data.frame(Titanic),
       aes(y = Freq,
           axis1 = Class, axis2 = Sex, axis3 = Age)) +
  
  #geom_alluvium设置中间的曲线:颜色填充,透明度,曲线类型
  geom_alluvium(aes(fill = Class))+
  
  # 设置中间框的格式
  geom_stratum()+
  
  # 对中间框上的标签进行设置
  geom_text(stat = "stratum", 
            aes(label = after_stat(stratum)),
            size = 5,angle=0,
            family = "Arial")+
  
  #自定义X和Y轴上的标签
  scale_x_continuous(breaks = 1:3, 
                     labels = c("Class", "Sex", "Age"),
                     expand = c(0,0))+
  scale_y_continuous(expand = c(0,0))+
  
  # 定义X和Y轴的名称
  labs(x = "Group", y = "Frequency")+
  
  
  # 设置图形主题样式
  theme_bw()+
  theme(legend.position = "none",
        text = element_text(family = "serif",
                            face = "bold",
                            size = 14))

5.也可以给加上一行代码coord_flip(),也可以变成下面这样

6.接下来我们对中间的方块进行颜色填充(## 为新添加的内容

ggplot(as.data.frame(Titanic),
       aes(y = Freq,
           axis1 = Class, axis2 = Sex, axis3 = Age)) +
  
  #geom_alluvium设置中间的曲线:颜色填充,透明度,曲线类型
  geom_alluvium(aes(fill = Class))+
  
  ## 设置中间框的格式
  geom_stratum(aes(fill = Class))+
  
  ## 设置填充的颜色板
  scale_fill_brewer(palette = "Set1")+
  
  # 对中间框上的标签进行设置
  geom_text(stat = "stratum", 
            aes(label = after_stat(stratum)),
            size = 5,angle=0,
            family = "Arial")+
  
  #自定义X和Y轴上的标签
  scale_x_continuous(breaks = 1:3, 
                     labels = c("Class", "Sex", "Age"),
                     expand = c(0,0))+
  scale_y_continuous(expand = c(0,0))+
  
  # 定义X和Y轴的名称
  labs(x = "Group", y = "Frequency")+
  
  
  # 设置图形主题样式
  theme_bw()+
  theme(legend.position = "none",
        text = element_text(family = "serif",
                            face = "bold",
                            size = 14))

7.上面我们只填充了第一列的颜色,这样,原本填充的geom_alluvium(aes(fill = Class))以及geom_stratum(aes(fill = Class))进行叠加之后,第一列的颜色就变深了。这样,整个数据能明显看出来数据流是从哪里出来的,流向哪里的。但如果我们将三列,即ClassSexAge都进行填充,会是什么效果呢?(## 为新添加的内容

ggplot(as.data.frame(Titanic),
       aes(y = Freq,
           axis1 = Class, axis2 = Sex, axis3 = Age)) +
  
  # geom_alluvium设置中间的曲线:颜色填充,透明度,曲线类型
  geom_alluvium(aes(fill = Class))+
  
  # 设置中间框的格式
  geom_stratum(aes(fill = Class))+
  
  ## 设置另外两列
  geom_stratum(aes(fill = Sex))+
  geom_stratum(aes(fill = Age))+
  
  # 设置填充的颜色板
  scale_fill_brewer(palette = "Set1")+
  
  # 对中间框上的标签进行设置
  geom_text(stat = "stratum", 
            aes(label = after_stat(stratum)),
            size = 5,angle=0,
            family = "Arial")+
  
  #自定义X和Y轴上的标签
  scale_x_continuous(breaks = 1:3, 
                     labels = c("Class", "Sex", "Age"),
                     expand = c(0,0))+
  scale_y_continuous(expand = c(0,0))+
  
  # 定义X和Y轴的名称
  labs(x = "Group", y = "Frequency")+
  
  
  # 设置图形主题样式
  theme_bw()+
  theme(legend.position = "none",
        text = element_text(family = "serif",
                            face = "bold",
                            size = 14))

8.填充之后颜色更加丰富,但其实由于颜色太多,图形数据分不清楚主次了,所以还是建议只填充第一列比较好,这样能看出来明显的数据流。你也可以将柱子填充为一种颜色(## 为新添加的内容)。显然,这种效果其实也并不是很好,因为桑基图,其实最好能看清楚,数据是从哪里流向哪里的,如果不能以这个为重点,就不太建议了

ggplot(as.data.frame(Titanic),
       aes(y = Freq,
           axis1 = Class, axis2 = Sex, axis3 = Age)) +
  
  # geom_alluvium设置中间的曲线:颜色填充,透明度,曲线类型
  geom_alluvium(aes(fill = Class))+
  
  ## 设置中间框的格式
  geom_stratum(fill = "lightblue")+
  
  # 设置填充的颜色板
  scale_fill_brewer(palette = "Set1")+
  
  # 对中间框上的标签进行设置
  geom_text(stat = "stratum", 
            aes(label = after_stat(stratum)),
            size = 5,angle=0,
            family = "Arial")+
  
  #自定义X和Y轴上的标签
  scale_x_continuous(breaks = 1:3, 
                     labels = c("Class", "Sex", "Age"),
                     expand = c(0,0))+
  scale_y_continuous(expand = c(0,0))+
  
  # 定义X和Y轴的名称
  labs(x = "Group", y = "Frequency")+
  
  
  # 设置图形主题样式
  theme_bw()+
  theme(legend.position = "none",
        text = element_text(family = "serif",
                            face = "bold",
                            size = 14))

9.另外有一点,就是数据的排列问题,比如第一列,数据大小并没有按照顺序排列;第二列也是

10.那么给加上一行代码decreasing = FALSE就行(## 为新添加的内容),这样,每列的数据都是从上到下,从大到小排列

ggplot(as.data.frame(Titanic),
       aes(y = Freq,
           axis1 = Class, axis2 = Sex, axis3 = Age)) +
  
  # geom_alluvium设置中间的曲线:颜色填充,透明度,曲线类型
  geom_alluvium(aes(fill = Class),
                ## 降序排列
                decreasing = FALSE)+
  
  ## 设置中间框的格式
  geom_stratum(aes(fill = Class),
               ## 降序排列
               decreasing = FALSE)+
  
  # 设置填充的颜色板
  scale_fill_brewer(palette = "Set1")+
  
  # 对中间框上的标签进行设置
  geom_text(stat = "stratum", 
            aes(label = after_stat(stratum)),
            size = 5,angle=0,
            family = "Arial",
            ## 降序排列
            decreasing = FALSE)+
  
  #自定义X和Y轴上的标签
  scale_x_continuous(breaks = 1:3, 
                     labels = c("Class", "Sex", "Age"),
                     expand = c(0,0))+
  scale_y_continuous(expand = c(0,0))+
  
  # 定义X和Y轴的名称
  labs(x = "Group", y = "Frequency")+
  
  # 设置图形主题样式
  theme_bw()+
  theme(legend.position = "none",
        text = element_text(family = "serif",
                            face = "bold",
                            size = 14))

11.改成decreasing = TRUE则是升序排列,即从上到下,从小到大排列

12.一定要同时升序或降序数据流、中间框、以及框里的文字,要不然就乱了。好了,这样的话基本就可以画出来自己比较满意的桑基图了。



相关推荐

有些人能留在你的心里,但不能留在你生活里。

有时候,你必须要明白,有些人能留在你的心里,但不能留在你生活里。Sometimes,youhavetorealize,Somepeoplecanstayinyourheart,...

Python学不会来打我(34)python函数爬取百度图片_附源码

随着人工智能和大数据的发展,图像数据的获取变得越来越重要。作为Python初学者,掌握如何从网页中抓取图片并保存到本地是一项非常实用的技能。本文将手把手教你使用Python函数编写一个简单的百度图片...

软网推荐:图像变变变 一“软”见分晓

当我们仅需要改变一些图片的分辨率、裁减尺寸、添加水印、标注文本、更改图片颜色,或将一种图片转换为另一种格式时,总比较讨厌使用一些大型的图像处理软件,尤其是当尚未安装此类软件时,更是如此。实际上,只需一...

首款WP8.1图片搜索应用,搜照片得资料

首款WP8.1图片搜索应用,搜照片得资料出处:IT之家原创(天际)2014-11-1114:32:15评论WP之家报道,《反向图片搜索》(ReverseImageSearch)是Window...

分享一组美图(图片来自头条)(头条美女头像)

...

盗墓笔记电视剧精美海报 盗墓笔记电视剧全集高清种子下载

出身“老九门”世家的吴邪,因身为考古学家的父母在某次保护国家文物行动时被国外盗墓团伙杀害,吴家为保护吴邪安全将他送去德国读书,因而吴邪对“考古”事业有着与生俱来的兴趣。在一次护宝过程中他偶然获得一张...

微软调整Win11 24H2装机策略:6月起36款预装应用改为完整版

IT之家7月16日消息,微软公司今天(7月16日)发布公告,表示自今年6月更新开始,已默认更新Windows1124H2和WindowsServer2025系统中预装...

谷歌手把手教你成为谣言终结者 | 域外

刺猬公社出品,必属原创,严禁转载。合作事宜,请联系微信号:yunlugongby贾宸琰编译、整理11月23日,由谷歌新闻实验室(GoogleNewsLab)联合Bellingcat、DigD...

NAS 部署网盘资源搜索神器:全网资源一键搜,免费看剧听歌超爽!

还在为找不到想看的电影、电视剧、音乐而烦恼?还在各个网盘之间来回切换,浪费大量时间?今天就教你如何在NAS上部署aipan-netdisk-search,一款强大的网盘资源搜索神器,让你全网资源...

使用 Docker Compose 简化 INFINI Console 与 Easysearch 环境搭建

前言回顾在上一篇文章《搭建持久化的INFINIConsole与Easysearch容器环境》中,我们详细介绍了如何使用基础的dockerrun命令,手动启动和配置INFINICon...

为庆祝杜特尔特到访,这个国家宣布全国放假?

(观察者网讯)近日,一篇流传甚广的脸书推文称,为庆祝杜特尔特去年访问印度,印度宣布全国放假,并举办了街头集会以示欢迎。菲媒对此做出澄清,这则消息其实是“假新闻”。据《菲律宾世界日报》2日报道,该贴子...

一课译词:毛骨悚然(毛骨悚然的意思是?)

PhotobyMoosePhotosfromPexels“毛骨悚然”,汉语成语,意思是毛发竖起,脊梁骨发冷;形容恐惧惊骇的样子(withone'shairstandingonend...

Bing Overtakes Google in China's PC Search Market, Fueled by AI and Microsoft Ecosystem

ScreenshotofBingChinahomepageTMTPOST--Inastunningturnintheglobalsearchenginerace,Mic...

找图不求人!6个以图搜图的识图网站推荐

【本文由小黑盒作者@crystalz于03月08日发布,转载请标明出处!】前言以图搜图,专业说法叫“反向图片搜索引擎”,是专门用来搜索相似图片、原始图片或图片来源的方法。常用来寻找现有图片的原始发布出...

浏览器功能和“油管”有什么关联?为什么要下载

现在有没有一款插件可以实现全部的功能,同时占用又小呢,主题主要是网站的一个外观,而且插件则主要是实现wordpress网站的一些功能,它不仅仅可以定制网站的外观,还可以实现很多插件的功能,搭载chro...