[R] 如何绘制各样本的pathway丰度热图？

前言

一般而言，我们做完pathway富集分析，就做下气泡图或bar图来进行展示，但它们实际上只考虑了富集因子和Pvalue。如果我们不关注这两个因素，而是在乎样本本身的pathway丰度呢？

对于KEGG热图绘制，大部分是做到KO层级，因为基因/蛋白和KO的绝大部分都是一对一的对应关系。如果一定要做Pathway的丰度热图呢？一般的方法是将该通路中的基因/蛋白的丰度进行累加来表示该pathway的丰度。

好了，现在我们来计算并绘制热图吧。

数据处理

得到pathway富集分析结果文件一般是这样的：

Proteins字段中的基因/蛋白是用分号隔开的。

> colnames(path)

[1] "X.Pathway"       "Sample1..1113."  "Sample2..15327." "Pvalue"          "Pathway.ID"      "Level1"

[7] "Level2"          "Proteins"        "KOs"

除此之外，我们还需要一个基因表达矩阵：

四组样本，每组3个重复，共12个。

我们的目标就是整理成这样的table，用来绘制热图：

从两个表可知，数据处理关键就是pathway中的蛋白丰度求和。把pathway中对应的各蛋白展开，再匹配到表达矩阵上，最后归并求和就好了，思路清晰了就动手吧。

library(tidyverse)

path2 <- path %>% dplyr::select(X.Pathway,Level1,Level2,Proteins)

#下面这一步最关键，dplyr中为我们提供了一个有用的函数unnest

path3 <- path2 %>% mutate(ProteinID = strsplit(Proteins, ";")) %>% unnest()

colnames(path3)[1] <- "Pathway"

#如果不熟悉，这一步也可用Map函数配合do.call来完成：

out <- do.call(rbind, Map(cbind, path2$X.Pathway,path2$Level1,path2$Level2,strsplit(path2$Proteins, ";")))

out <- as.data.frame(out)

colnames(out) <- colnames(path2)

得到的结果是这样的：

Proteins列中的蛋白都一一和Pathway对应起来了。后面就好办了，直接贴代码：

#sum scale

ibaq2 <- sweep(ibaq,2,apply(ibaq, 2, sum),FUN = "/")

#caculate each group mean value

group <- factor(rep(c("S01CC","S11SC","S12CC","S12SC"),each=3),levels = c("S11SC","S12SC","S12CC","S01CC"))

out <- apply(ibaq2,1,function(x){

  dat <- data.frame(group=group,value=x)

  dat_mean <- dat %>% group_by(group) %>% summarise(mean=mean(value)) %>% select(mean)

})  #注意此处计算均值未用na.rm参数

out[[1]]

out2 <- as.data.frame(t(do.call(cbind,out)))

colnames(out2) <- levels(group)

rownames(out2) <- rownames(ibaq2)

exp <- data.frame(ProteinID=rownames(out2),out2)

data1 <- left_join(path3,exp,by="ProteinID") %>% dplyr::select(1:3,6:9) %>%

  gather(Sample,Abundance,-c(Pathway,Level1,Level2)) %>%

  group_by(Pathway,Sample) %>% summarise(Sum=sum(Abundance)) %>%

  spread(Sample,Sum)

tmp <- path3[1:3]

annotation <- tmp[!duplicated(tmp),]

length(intersect(data1$Pathway,annotation$Pathway))

#先按pathway排序，再按level2,level1排序

plotdat <- left_join(annotation,data1,by="Pathway") %>%

  arrange(Pathway) %>%

  arrange(Level2) %>% arrange(Level1)

现在已经得到想要的数据了。

绘图

这个就不用多解释了。

library(pheatmap)

Exp_log2=plotdat  #实际上我中间处理了别的，这里便于绘图直接赋值

colnames(Exp_log2)

exp_plot <- select(Exp_log2,S11SC,S12SC,S12CC,S01CC)

rownames(exp_plot) <- Exp_log2$Pathway

annotation_row <- select(Exp_log2,Level2,Level1)

rownames(annotation_row) <- Exp_log2$Pathway

pheatmap(exp_plot,cluster_rows = F,cluster_cols = F,scale = "row",

         annotation_row = annotation_row,

          border_color = NA,

          #angle_col=45,

          color = colorRampPalette(c("blue","white","red"))(50))

图片大概成这样：

根据需要挑选一些pathway展示吧，太多不好看。

Ref: https://stackoverflow.com/questions/28719088/r-semicolon-delimited-a-column-into-rows

[R] 如何绘制各样本的pathway丰度热图？的更多相关文章

RNA_seq 热图绘制
若已经拿到表达矩阵exprSet 若差异较大,进行log缩小不同样本的差距 1.热图全体 1 ##加载包 2 library(pheatmap) 3 4 ##缩小表达量差距 5 exprSet < ...
R语言绘制花瓣图flower plot
R语言中有很多现成的R包,可以绘制venn图,但是最多支持5组,当组别数大于5时,venn图即使能够画出来,看上去也非常复杂,不够直观: 在实际的数据分析中,组别大于5的情况还是经常遇到的,这是就可以 ...
R语言绘制相对性关系图
准备第一步就是安装R语言环境以及RStudio 图绘制准备首先安装库文件,敲入指令,回车 install.packages('corrplot') 然后安装excel导入的插件,点击右上角impo ...
R语言学习 - 热图绘制heatmap
生成测试数据绘图首先需要数据.通过生成一堆的向量,转换为矩阵,得到想要的数据. data <- c(1:6, 6:1, 6:1, 1:6, (6:1)/10, (1:6)/10, (1:6)/ ...
一幅图解决R语言绘制图例的各种问题
一幅图解决R语言绘制图例的各种问题用R语言画图的小伙伴们有木有这样的感受,"命令写的很完整,运行没有报错,可图例藏哪去了?""图画的很美,怎么总是图例不协调?" ...
用R包中heatmap画热图
一:导入R包及需要画热图的数据 library(pheatmap) data<- read.table("F:/R练习/R测试数据/heatmapdata.txt",head ...
pheatmap绘制“热图”，你需要的都在这
热图可以聚合大量的数据,并可以用一种渐进色来优雅地表现,可以很直观地展现数据的疏密程度或频率高低. 本文利用R语言 pheatmap 包从头开始绘制各种漂亮的热图.参数像积木,拼凑出你最喜欢的热图即可 ...
html5 canvas绘制环形进度条，环形渐变色仪表图
html5 canvas绘制环形进度条,环形渐变色仪表图在绘制圆环前,我们需要知道canvas arc() 方 ...
解读人：刘佳维，Spectral Clustering Improves Label-Free Quantiﬁcation of Low-Abundant Proteins（谱图聚类改善了低丰度蛋白的无标记定量）
发表时间:(2019年4月) IF:3.95 单位: 维也纳医科大学: 欧洲生物信息研究所(EMBL-EBI): 分子病理学研究所: 奥地利科学院分子生物技术研究所: Gregor Mendel分子植 ...

随机推荐

如何访问位于内网的Ubuntu主机
如何访问位于内网的Ubuntu主机内网主机为Ubuntu桌面版内网主机Ubuntu字符串界面版 SSH远程主机管理工具推荐 SSH远程文件访问工具推荐如何访问位于内网的Ubuntu主机内网主机 ...
Alpha项目展示
项目内容这个作业属于哪个课程 2021春季软件工程(罗杰任健) 这个作业的要求在哪里 Alpha-项目展示我们是谁删库跑路对不队我们在做什么题士进度如何进度总览一.项目与团队亮点 ...
[no code] Scrum Meeting 博客目录
项目内容 2020春季计算机学院软件工程(罗杰任健) 2020春季计算机学院软件工程(罗杰任健) 作业要求 Scrum Meeting博客目录我们在这个课程的目标是远程协同工作,采用最新技术 ...
[火星补锅] 水题大战Vol.2 T2 && luogu P3623 [APIO2008]免费道路题解
前言: 如果我自己写的话,或许能想出来正解,但是多半会因为整不出正确性而弃掉. 解析: 这题算是对Kruskal的熟练运用吧. 要求一颗生成树.也就是说,最后的边数是确定的. 首先我们容易想到一个策略 ...
TCP/IP参考模型（应用层、传输层、网际层、网络接口层）、五层参考模型（应用层、传输层、网络层、数据链路层、物理层）、OSI与TCP/IP参考模型比较
文章转自:https://blog.csdn.net/weixin_43914604/article/details/104597450 学习课程:<2019王道考研计算机网络> 学习目的 ...
picGo+gitee搭建Obsidian图床，实现高效写作
1 picGo安装 [picgo下载链接](https://molunerfinn.com/PicGo/) 选择安装目录,可以选择安装在D:\Program Files 然后点击安装即可 2. git ...
最小的K个数牛客网剑指Offer
最小的K个数牛客网剑指Offer 题目描述输入n个整数,找出其中最小的K个数.例如输入4,5,1,6,2,7,3,8这8个数字,则最小的4个数字是1,2,3,4,. class Solution ...
第一个只出现一次字符的位置牛客网剑指Offer
第一个只出现一次字符的位置牛客网剑指Offer 题目描述在一个字符串(0<=字符串长度<=10000,全部由字母组成)中找到第一个只出现一次的字符,并返回它的位置, 如果没有则返回 ...
VS2013快捷键及技巧 / 智能插件
复制/剪切/删除整行代码 1)如果你想复制一整行代码,只需将光标移至该行,再使用组合键"Ctrl+C"来完成复制操作,而无需选择整行. 2)如果你想剪切一整行代码,只需将光标移至该 ...
一步一步学ROP之linux_x86篇(蒸米spark)
目录一步一步学ROP之linux_x86篇(蒸米spark) 0x00 序 0x01 Control Flow Hijack 程序流劫持 0x02 Ret2libc – Bypass DEP 通过r ...

[R] 如何绘制各样本的pathway丰度热图？

前言

数据处理

绘图

[R] 如何绘制各样本的pathway丰度热图？的更多相关文章

随机推荐

热门专题