百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 热门文章 > 正文

干货丨如何绘制新颖好看的火山图?

bigegpt 2024-09-27 00:36 4 浏览

火山图(Volcano plot)是一种比较“远古”的一种散点图,广泛应用于转录组、蛋白组等组间差异分析结果的展示。图表的横轴一般展示差异倍数的变化,而纵轴表示差异分析结果的可靠性。通过找到显著差异的基因,研究者可以进一步做后续的实验。

在生物信息分析中,火山图是非常常见的一种数据展示形式。由于火山图可以非常清晰的展示出哪些基因在不同样本中是具有差异表达显著性的基因,因此在生物医学中,常应用于病例和对照组的转录组研究,也能应用于基因组,蛋白质组,代谢组等统计数据。

常见火山图类型:

那如何做出并读懂这类图,下面进入实战部分吧!



01
数据的准备

绘制火山图的方法非常多,常用的有:使用R语言中的ggplot2包EnhancedVolcano包Origin等绘制高颜值火山图,下面我们介绍‘使用R语言中的ggplot2包’方法绘制火山图。

首先,安装并且载入相关的R包

install.packages(c("ggrepel", "dplyr", "gt"))

# 载入R包
library(dplyr) # 用于数据处理
library(ggrepel) # 给图片贴上标签
library(gt) # 制作表格

接下来准备作图的数据。

今天用到的RNA-seq数据是经{DESeq2}包处理后的,数据的格式是文本text,可直接导入到R中:

mydata <- read.table("https://gist.githubusercontent.com/stephenturner/806e31fce55a8b7175af/raw/9479acb809fae09aa50ea7df54a1199b3f1ffa11/results.txt", header = TRUE, sep = "")

等数据下载完毕,再查看数据的前六行, 同样是使用代码:

# 查看数据
head(mydata) %>% # 查看数据的前六行
gt() # 制作成表格

每个点代表一个检测到的基因。

横轴和纵轴用于固定点在空间的位置。

一般横轴是Log2(fold change),点越偏离中心,表示差异倍数越大。

纵轴是-Log 10 (adjusted P-value),点越靠图的顶部表示差异越显著。

点的大小和颜色也可以表示更多的属性,如后面图中点的颜色标记其对应的基因是上调, 下调还是无差异

大小也可用于展示基因表达的平均丰度,一般我们关注表达水平较高且差异较大的基因用于后续的分析和验证。


02制作基础版本的火山图

现在万事俱备,开始作图:

volc_plot <- ggplot(mydata, aes(log2FoldChange, -log10(pvalue))) +# 将p值进行-log10转化
geom_point(size = 0.4) + # 调整点的大小
xlab(expression("log"[2]*" fold change")) + # 修饰横坐标的题目
ylab(expression("-log"[10]*" p-value")) + # 修饰纵坐标的题目
scale_x_continuous(limits = c(-2.5, 2.5)) + # 调整横坐标的范围
theme_minimal()

volc_plot

基本的火山图已经搞定!接下来根据基因的表达水平进行着色


03根据基因的表达水平进行着色

首先,我们设定一下基因表达水平的规则:

将“fold change”≥2[即log2(2) = 1]并且p<0.05的基因标记为:“上调”; 将“fold change” ≤0.5[即log2(0.5) = -1]并且p<0.05的基因标记为:“下调”; 剩下其他的基因则标记为:“不变”。

数据部分可以这么操作:

# 数据处理
mydata1 <- mydata %>%
mutate(expression = case_when(log2FoldChange >= 1 & pvalue < 0.05 ~ "Up-regulated", # 上调
log2FoldChange <= -1 & pvalue < 0.05 ~ "Down-regulated", # 下调
TRUE ~ "Unchanged")) # 不变

# 查看数据
head(mydata1) %>% # 查看前六行
gt() # 制作表格


从上可知,新加了一个名为expression的变量,用于标注基因的表达情况。

接下来,根据expression的不同,将基因进行着色:

volc_plot1 <- ggplot(mydata1, aes(log2FoldChange, -log10(pvalue))) +
geom_point(size = 1.4, aes(color = expression)) + # 根据expression水平进行着色
xlab(expression("log"[2]*" fold change")) + # 修饰x轴题目
ylab(expression("-log"[10]*" p-value")) + # 修饰y轴题目
scale_x_continuous(limits = c(-2.5, 2.5)) +
scale_color_manual(values = c("steelblue", "grey", "red")) + # 添加三种颜色
theme_minimal()

volc_plot1

左侧蓝色的点为下调的基因(并且有统计学意义),右侧红色的点为上调的基因(并且有统计学意义),而中间灰色的指的是表达水平差异不显著的基因。

现在终于明白,为啥将p值进行-log10转化,将“fold change”进行log2转化了。因为转化后,只要看图的左上角(蓝色)和右上角(红色),就马上可以识别出下调和上调的基因!



04
分别标注出上调或下调最显著的5个基因

因为将所有基因的名字都标注起来是不可能的,整个画面会像一团浆糊!所以小编只标注上调或下调最显著的前5个基因,共10个,可以这么做:

top_10 <-bind_rows(
mydata1 %>%
filter(expression == 'Up-regulated') %>%
arrange(pvalue, desc(abs(log2FoldChange))) %>%
head(5),
mydata1 %>%
filter(expression == 'Down-regulated') %>%
arrange(pvalue, desc(abs(log2FoldChange))) %>%
head(5)
)

top_10 %>% gt()

接下来,使用top_10里面的基因名称标注火山图:

volc_plot2 <- volc_plot1 +
geom_label_repel(data = top_10,
aes(log2FoldChange, -log10(pvalue), label = Gene),
size = 2)
volc_plot2

火山图的本质就是一张散点图,我们只要理清了绘图逻辑,无论用什么软件,都可以绘制出漂亮的火山图!

相关推荐

有些人能留在你的心里,但不能留在你生活里。

有时候,你必须要明白,有些人能留在你的心里,但不能留在你生活里。Sometimes,youhavetorealize,Somepeoplecanstayinyourheart,...

Python学不会来打我(34)python函数爬取百度图片_附源码

随着人工智能和大数据的发展,图像数据的获取变得越来越重要。作为Python初学者,掌握如何从网页中抓取图片并保存到本地是一项非常实用的技能。本文将手把手教你使用Python函数编写一个简单的百度图片...

软网推荐:图像变变变 一“软”见分晓

当我们仅需要改变一些图片的分辨率、裁减尺寸、添加水印、标注文本、更改图片颜色,或将一种图片转换为另一种格式时,总比较讨厌使用一些大型的图像处理软件,尤其是当尚未安装此类软件时,更是如此。实际上,只需一...

首款WP8.1图片搜索应用,搜照片得资料

首款WP8.1图片搜索应用,搜照片得资料出处:IT之家原创(天际)2014-11-1114:32:15评论WP之家报道,《反向图片搜索》(ReverseImageSearch)是Window...

分享一组美图(图片来自头条)(头条美女头像)

...

盗墓笔记电视剧精美海报 盗墓笔记电视剧全集高清种子下载

出身“老九门”世家的吴邪,因身为考古学家的父母在某次保护国家文物行动时被国外盗墓团伙杀害,吴家为保护吴邪安全将他送去德国读书,因而吴邪对“考古”事业有着与生俱来的兴趣。在一次护宝过程中他偶然获得一张...

微软调整Win11 24H2装机策略:6月起36款预装应用改为完整版

IT之家7月16日消息,微软公司今天(7月16日)发布公告,表示自今年6月更新开始,已默认更新Windows1124H2和WindowsServer2025系统中预装...

谷歌手把手教你成为谣言终结者 | 域外

刺猬公社出品,必属原创,严禁转载。合作事宜,请联系微信号:yunlugongby贾宸琰编译、整理11月23日,由谷歌新闻实验室(GoogleNewsLab)联合Bellingcat、DigD...

NAS 部署网盘资源搜索神器:全网资源一键搜,免费看剧听歌超爽!

还在为找不到想看的电影、电视剧、音乐而烦恼?还在各个网盘之间来回切换,浪费大量时间?今天就教你如何在NAS上部署aipan-netdisk-search,一款强大的网盘资源搜索神器,让你全网资源...

使用 Docker Compose 简化 INFINI Console 与 Easysearch 环境搭建

前言回顾在上一篇文章《搭建持久化的INFINIConsole与Easysearch容器环境》中,我们详细介绍了如何使用基础的dockerrun命令,手动启动和配置INFINICon...

为庆祝杜特尔特到访,这个国家宣布全国放假?

(观察者网讯)近日,一篇流传甚广的脸书推文称,为庆祝杜特尔特去年访问印度,印度宣布全国放假,并举办了街头集会以示欢迎。菲媒对此做出澄清,这则消息其实是“假新闻”。据《菲律宾世界日报》2日报道,该贴子...

一课译词:毛骨悚然(毛骨悚然的意思是?)

PhotobyMoosePhotosfromPexels“毛骨悚然”,汉语成语,意思是毛发竖起,脊梁骨发冷;形容恐惧惊骇的样子(withone'shairstandingonend...

Bing Overtakes Google in China&#39;s PC Search Market, Fueled by AI and Microsoft Ecosystem

ScreenshotofBingChinahomepageTMTPOST--Inastunningturnintheglobalsearchenginerace,Mic...

找图不求人!6个以图搜图的识图网站推荐

【本文由小黑盒作者@crystalz于03月08日发布,转载请标明出处!】前言以图搜图,专业说法叫“反向图片搜索引擎”,是专门用来搜索相似图片、原始图片或图片来源的方法。常用来寻找现有图片的原始发布出...

浏览器功能和“油管”有什么关联?为什么要下载

现在有没有一款插件可以实现全部的功能,同时占用又小呢,主题主要是网站的一个外观,而且插件则主要是实现wordpress网站的一些功能,它不仅仅可以定制网站的外观,还可以实现很多插件的功能,搭载chro...