Mfuzz進(jìn)行時(shí)序表達(dá)聚類分析(Mac)

懶癌的我全靠Jimmy催著學(xué)習(xí)鉴吹,4月份答應(yīng)交這份作業(yè)的东揣,離中間被催又過了一個(gè)多月,今天完成啦铲敛。

數(shù)據(jù)來源: 擬南芥RNA-seq轉(zhuǎn)錄組分析-salmon(Mac版)
上游分析為salmon直接定量分析(純Mac版)待错,下游分析如下:

1. 軟件安裝

如果有直接library("包名")籽孙,但這一步?jīng)]有安裝的,直接用install.packages("包名安裝")火俄,如果安裝不成功犯建,用BiocManager::install("包名"),詳情參考R包升級(jí)報(bào)錯(cuò)成常態(tài),搜索告訴你。瓜客。适瓦。

#清空環(huán)境
rm(list = ls()) 
options(stringsAsFactors = F)
#設(shè)置鏡像
options()$repos 
options()$BioC_mirror
options(BioC_mirror="https://mirrors.ustc.edu.cn/bioc/")
options("repos" = c(CRAN="https://mirrors.tuna.tsinghua.edu.cn/CRAN/"))
options()$repos 
options()$BioC_mirror

install.packages("tidyverse") ; library(tidyverse)
install.packages("optparse") ; library(optparse)
install.packages("UpSetR") ; library(UpSetR)
install.packages("rjson") ; library(rjson)
install.packages("Mfuzz"); library(Mfuzz)
# https://bioconductor.org/packages/release/bioc/html/GEOquery.html
if (!requireNamespace("BiocManager", quietly = TRUE))
  install.packages("BiocManager")
BiocManager::install(c("tximport","KEGG.db","DESeq2","edgeR" ,"org.At.tair.db","pheatmap","AnnotationHub"),ask = F,update = F)
BiocManager::install(c("clusterProfiler","limma","DOSE","GenomicFeatures","RColorBrewer"),ask = F,update = F)

2. 打開Rstudio竿开,加載salmon得到的counts

2.1 加載到counts所在的路徑
#setwd將Rstudio的工作目錄設(shè)置到存儲(chǔ)counts的路徑
setwd("~/data/")
getwd()
dir=getwd()
files=list.files(pattern = "*sf",dir,recursive = T)
files=file.path(dir,files)
all(file.exists(files))
2.2 注釋信息獲取
#注釋信息的數(shù)據(jù)庫,目前最新的工具包叫做AnnotationHub
library(AnnotationHub)
#此報(bào)錯(cuò)不定期出現(xiàn),有時(shí)加載很多次都會(huì)出現(xiàn)如圖ah1的報(bào)錯(cuò)玻熙,可能是網(wǎng)絡(luò)原因否彩,ah2位加載成功, 
ah <- AnnotationHub()
#查找包中擬南芥的數(shù)據(jù)
ath <- query(ah,'Arabidopsis thaliana')
#下載最新的注釋ID,此步驟會(huì)出現(xiàn)ah一步類似的報(bào)錯(cuò)揭芍,多試幾次
ath_tx <- ath[['AH52247']]
#提取數(shù)據(jù)庫中GENEID信息
columns(ath_tx)
k <- keys(ath_tx,keytype = "GENEID")
df <- select(ath_tx, keys=k, keytype = "GENEID",columns = "TXNAME")
tx2gene <- df[,2:1]
2.3 加載數(shù)據(jù)
library('tximport')
library('readr')
txi=tximport(files ,type = "salmon",tx2gene = tx2gene)
head(txi)
head(txi$length)
files
# 加載stringr包,為了得到將txi的列名定義為樣本名
library(stringr)
# 以'\'為分隔符胳搞,將含有quant.sf的路徑分割,并提第七列---取樣本名(ERR1698194_quant)
t1=sapply(strsplit(files,'\\/'),function(x)x[6])
# txi 的列counts的列名為樣本名,
colnames(txi$counts)=sapply(strsplit(t1,'_'),function(x)x[1])
tmp=txi$counts
head(tmp)
# 1為行称杨,2為列,將列都轉(zhuǎn)化為整數(shù)
exprSet=apply(tmp,2, as.integer)
rownames(exprSet)=rownames(tmp)
#查看表達(dá)兩信息
head(exprSet)
dim(exprSet)
exprSet=as.data.frame(exprSet)
save(exprSet,file=paste0('quants-exprSet.Rdata'))

#準(zhǔn)備樣本信息
sampleTable=read.csv("sampleTable.txt",sep="\t",header = FALSE)
colnames(sampleTable)=c("sample","group_list")
rownames(sampleTable)=sampleTable[,1]
sampleTable=sampleTable[,-1,drop=FALSE]
sampleTable$group_list=paste0("day",sampleTable$group_list)

# 將counts和樣品名對(duì)應(yīng)
names(txi)
head(txi$counts)
head(txi$length)
colnames(txi$length)=colnames(txi$counts)
colnames(txi$abundance)=colnames(txi$counts)
txi$counts[1:4,1:4]

3. 差異分析

分三步: 構(gòu)建矩陣-均一化-表達(dá)矩陣

3.1 構(gòu)建矩陣
library('DESeq2')
dds<-DESeqDataSetFromTximport(txi,sampleTable,design = ~group_list)
dim(dds)
#數(shù)據(jù)過濾
dds <- dds[rowSums(counts(dds))>1,]
dim(dds)

suppressMessages(dds2 <- DESeq(dds))
res <- results(dds2)
summary(res)
3.2 均一化
rld=rlogTransformation(dds2)
exprSet_new=assay(rld)
head(exprSet_new)
dim(exprSet_new)
3.3 表達(dá)矩陣
resultsNames(dds2)
res0vs1= results(dds2,contrast = c("group_list","day1","day0"))
resOrdered1=res0vs1[order(res0vs1$padj),]
resOrdered1=as.data.frame(resOrdered1)
head(resOrdered1)

library("org.At.tair.db")
library("KEGG.db")
library("clusterProfiler")
library('ggplot2')
resOrdered1$gene_id=rownames(resOrdered1)
id2symbol=toTable(org.At.tairSYMBOL)
resOrdered1=merge(resOrdered1,id2symbol,by='gene_id')

DEG=resOrdered1
colnames(DEG)=colnames(DEG)=c('gene_id' ,'baseMean','logFC','lfcSE','stat','pvalue' , 'P.Value' , 'symbol')

DEG$symbol=as.character(DEG$symbol)
DEG_filter=DEG[nchar(DEG$symbol)>1,]
DEG_filter=DEG_filter[!is.na(DEG_filter$symbol),]

4. 時(shí)序表達(dá)聚類分析

用3.2 均一化(normalisation)后的表達(dá)矩陣

library("Mfuzz")
library('dplyr')

count <- data.matrix(exprSet_new)
eset <- new("ExpressionSet",exprs = count)
# 根據(jù)標(biāo)準(zhǔn)差去除樣本間差異太小的基因
eset <- filter.std(eset,min.std=0)
eset <- standardise(eset)
image.png
# 如何決定聚類個(gè)數(shù)筷转?
c <- 6
#  評(píng)估出最佳的m值
m <- mestimate(eset)
# 聚類
cl <- mfuzz(eset, c = c, m = m)

mfuzz.plot(
  eset,
  cl,
  mfrow=c(2,3),
  new.window= FALSE)

聚類個(gè)數(shù)位6


image.png

聚類個(gè)數(shù)位16


image.png

基因表達(dá)聚類姑原,黃線和綠線表示隨時(shí)間變化表達(dá)量相差小的基因,紅線和紫線表明隨時(shí)間變化表大量相差大的基因呜舒。

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請(qǐng)聯(lián)系作者
  • 序言:七十年代末锭汛,一起剝皮案震驚了整個(gè)濱河市,隨后出現(xiàn)的幾起案子袭蝗,更是在濱河造成了極大的恐慌唤殴,老刑警劉巖,帶你破解...
    沈念sama閱讀 206,723評(píng)論 6 481
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件到腥,死亡現(xiàn)場(chǎng)離奇詭異朵逝,居然都是意外死亡,警方通過查閱死者的電腦和手機(jī)乡范,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 88,485評(píng)論 2 382
  • 文/潘曉璐 我一進(jìn)店門配名,熙熙樓的掌柜王于貴愁眉苦臉地迎上來,“玉大人晋辆,你說我怎么就攤上這事渠脉。” “怎么了瓶佳?”我有些...
    開封第一講書人閱讀 152,998評(píng)論 0 344
  • 文/不壞的土叔 我叫張陵芋膘,是天一觀的道長(zhǎng)。 經(jīng)常有香客問我霸饲,道長(zhǎng)为朋,這世上最難降的妖魔是什么? 我笑而不...
    開封第一講書人閱讀 55,323評(píng)論 1 279
  • 正文 為了忘掉前任贴彼,我火速辦了婚禮潜腻,結(jié)果婚禮上,老公的妹妹穿的比我還像新娘器仗。我一直安慰自己融涣,他們只是感情好童番,可當(dāng)我...
    茶點(diǎn)故事閱讀 64,355評(píng)論 5 374
  • 文/花漫 我一把揭開白布。 她就那樣靜靜地躺著威鹿,像睡著了一般剃斧。 火紅的嫁衣襯著肌膚如雪。 梳的紋絲不亂的頭發(fā)上忽你,一...
    開封第一講書人閱讀 49,079評(píng)論 1 285
  • 那天幼东,我揣著相機(jī)與錄音,去河邊找鬼科雳。 笑死根蟹,一個(gè)胖子當(dāng)著我的面吹牛,可吹牛的內(nèi)容都是我干的糟秘。 我是一名探鬼主播简逮,決...
    沈念sama閱讀 38,389評(píng)論 3 400
  • 文/蒼蘭香墨 我猛地睜開眼,長(zhǎng)吁一口氣:“原來是場(chǎng)噩夢(mèng)啊……” “哼尿赚!你這毒婦竟也來了散庶?” 一聲冷哼從身側(cè)響起,我...
    開封第一講書人閱讀 37,019評(píng)論 0 259
  • 序言:老撾萬榮一對(duì)情侶失蹤凌净,失蹤者是張志新(化名)和其女友劉穎悲龟,沒想到半個(gè)月后,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體冰寻,經(jīng)...
    沈念sama閱讀 43,519評(píng)論 1 300
  • 正文 獨(dú)居荒郊野嶺守林人離奇死亡须教,尸身上長(zhǎng)有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點(diǎn)故事閱讀 35,971評(píng)論 2 325
  • 正文 我和宋清朗相戀三年,在試婚紗的時(shí)候發(fā)現(xiàn)自己被綠了性雄。 大學(xué)時(shí)的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片没卸。...
    茶點(diǎn)故事閱讀 38,100評(píng)論 1 333
  • 序言:一個(gè)原本活蹦亂跳的男人離奇死亡,死狀恐怖秒旋,靈堂內(nèi)的尸體忽然破棺而出约计,到底是詐尸還是另有隱情,我是刑警寧澤迁筛,帶...
    沈念sama閱讀 33,738評(píng)論 4 324
  • 正文 年R本政府宣布煤蚌,位于F島的核電站,受9級(jí)特大地震影響细卧,放射性物質(zhì)發(fā)生泄漏尉桩。R本人自食惡果不足惜,卻給世界環(huán)境...
    茶點(diǎn)故事閱讀 39,293評(píng)論 3 307
  • 文/蒙蒙 一贪庙、第九天 我趴在偏房一處隱蔽的房頂上張望蜘犁。 院中可真熱鬧,春花似錦止邮、人聲如沸这橙。這莊子的主人今日做“春日...
    開封第一講書人閱讀 30,289評(píng)論 0 19
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽屈扎。三九已至埃唯,卻和暖如春,著一層夾襖步出監(jiān)牢的瞬間鹰晨,已是汗流浹背墨叛。 一陣腳步聲響...
    開封第一講書人閱讀 31,517評(píng)論 1 262
  • 我被黑心中介騙來泰國(guó)打工, 沒想到剛下飛機(jī)就差點(diǎn)兒被人妖公主榨干…… 1. 我叫王不留模蜡,地道東北人漠趁。 一個(gè)月前我還...
    沈念sama閱讀 45,547評(píng)論 2 354
  • 正文 我出身青樓,卻偏偏與公主長(zhǎng)得像哩牍,于是被迫代替她去往敵國(guó)和親棚潦。 傳聞我的和親對(duì)象是個(gè)殘疾皇子,可洞房花燭夜當(dāng)晚...
    茶點(diǎn)故事閱讀 42,834評(píng)論 2 345

推薦閱讀更多精彩內(nèi)容