轉(zhuǎn)錄組數(shù)據(jù)分析—DEseq2差異分析

轉(zhuǎn)錄組測序的目的之一偿短,就是探索組間顯著表達變化的基因——差異表達基因干发。
那么郎任,如何基于轉(zhuǎn)錄組測序獲得的定量表達值,識別差異表達變化的基因或其它非編碼RNA分子呢番官?
DESeq2是目前文獻中尋找差異基因使用頻率最高的R包之一庐完。

DEseq2安裝

#若未安裝“BiocManager”
if (!require("BiocManager", quietly = TRUE))
    install.packages("BiocManager")
BiocManager::install("DESeq2")

#若已安裝“BiocManager”
library(BiocManager)
BiocManager::install("DESeq2")

安裝完成直接library使用即可。

差異分析

DESeq2是一種基于負(fù)二項式分布的方法徘熔,使用局部回歸推算均值和方差门躯,通過離散度和倍數(shù)變化的收縮率估計以提高穩(wěn)定性。定量分析關(guān)注的更多是差異表達的“強度”酷师,而非“存在”讶凉。

輸入數(shù)據(jù)

表達量矩陣(我們就是用之前使用RNA-seq數(shù)據(jù)分析—HTseq定量的結(jié)果即可),若有自己的數(shù)據(jù)要求如下:

  • 輸入數(shù)據(jù)是由整數(shù)組成的矩陣山孔。
  • 矩陣是沒有標(biāo)準(zhǔn)化的懂讯。


篩選差異基因

差異分析
DESeq2包分析差異表達基因簡單來說只有三步:構(gòu)建dds矩陣,標(biāo)準(zhǔn)化饱须,以及進行差異分析域醇,我利用以下代碼實現(xiàn):

setwd("F:/RNA-Seq/GSE176393(SRP323246)/5-Diff")

library(DESeq2)

#讀入輸入數(shù)據(jù),設(shè)計差異分組
rawdata <- read.table("rawread.txt",header=T,sep = "\t",row.names = 1)
diffcount <- rawdata[,1:6]  ##由于我的數(shù)據(jù)有三個條件蓉媳,所以我把需要進行差異分析的兩組數(shù)據(jù)挑選出來譬挚,若分析數(shù)據(jù)僅包含兩種條件則可不運行
sampleTable <- data.frame(condition = factor(rep(c("Control", "shBmal1"), each = 3))) ##可以依據(jù)實際情況修改各個條件的名稱及數(shù)量

#構(gòu)建dds矩陣
dds <- DESeqDataSetFromMatrix(countData = round(diffcount), colData = sampleTable, design = ~condition)
#對原始dds進行normalize
dds <- DESeq(dds)
res <- results(dds)# 將結(jié)果用results()函數(shù)來獲取,賦值給res變量

#保存全部差異結(jié)果
diff_res <- as.data.frame(res)
diff_res$gene_id <- rownames(diff_res)
diff_res<-diff_res[, colnames(diff_res)[c(7,1:6)]]
write.table(diff_res,file = 'All_DESeq2_results.xls',sep = '\t',row.names = FALSE)

#依據(jù)提取符合閾值的差異結(jié)果
table(diff_res$padj<0.05) #取FDR小于0.05的結(jié)果酪呻,閾值可依據(jù)實際需要調(diào)整
diff_FDR <- diff_res[order(diff_res$padj),]
diff_gene_deseq2_FDR <-subset(diff_FDR,padj < 0.05 & (log2FoldChange > 1 | log2FoldChange < -1)) #閾值可依據(jù)實際需要調(diào)整
write.table(diff_gene_deseq2_FDR,file= "diff_gene_deseq2_FDR.xls",sep = '\t',row.names = F)

table(diff_res$pvalue<0.05) #取P值小于0.05的結(jié)果
diff_p <- diff_res[order(diff_res$pvalue),]
diff_gene_deseq2_p <-subset(diff_p,pvalue < 0.05 & (log2FoldChange > 1 | log2FoldChange < -1)) #閾值可依據(jù)實際需要調(diào)整
write.table(diff_gene_deseq2_p,file= "diff_gene_deseq2_pvalue.xls",sep = '\t',row.names = F)

可視化

差異結(jié)果的可視化以火山圖形式呈現(xiàn):

#繪制火山圖(FDR篩選)
library(ggplot2)

cut_off_stat = 0.05 #設(shè)置統(tǒng)計值閾值
cut_off_logFC = 1 #設(shè)置表達量閾值,可修改
diff_res[is.na(diff_res)] <- 0
diff_res$change = ifelse(diff_res$padj < cut_off_stat & abs(diff_res$log2FoldChange) >= cut_off_logFC, 
                        ifelse(diff_res$log2FoldChange> cut_off_logFC ,'Up','Down'),
                        'Stable') 
pdf("volcanol_FDR.pdf")
ggplot(diff_res, 
  aes(x = log2FoldChange, 
      y = -log10(padj), 
      colour=change)) +
  geom_point(alpha=0.4, size=3.5) +
  scale_color_manual(values=c("#546de5", "#d2dae2","#ff4757"))+
  geom_vline(xintercept=c(-1,1),lty=4,col="black",lwd=0.8) +
  geom_hline(yintercept = -log10(cut_off_stat),lty=4,col="black",lwd=0.8) +
  labs(x="log2(fold change)",
       y="-log10 (FDR)")+
  theme_bw()+
  theme(plot.title = element_text(hjust = 0.5), 
        legend.position="right", 
        legend.title = element_blank()
  )
dev.off()

#繪制火山圖(pvalue篩選)

library(ggplot2)

cut_off_stat = 0.05 #設(shè)置統(tǒng)計值閾值
cut_off_logFC = 1 #設(shè)置表達量閾值,可修改
diff_res[is.na(diff_res)] <- 0
diff_res$change = ifelse(diff_res$pvalue < cut_off_stat & abs(diff_res$log2FoldChange) >= cut_off_logFC, 
                         ifelse(diff_res$log2FoldChange> cut_off_logFC ,'Up','Down'),
                         'Stable')
pdf("volcanol_pvalue.pdf")
ggplot(diff_res, 
       aes(x = log2FoldChange, 
           y = -log10(pvalue), 
           colour=change)) +
  geom_point(alpha=0.4, size=3.5) +
  scale_color_manual(values=c("#546de5", "#d2dae2","#ff4757"))+
  geom_vline(xintercept=c(-1,1),lty=4,col="black",lwd=0.8) +
  geom_hline(yintercept = -log10(cut_off_stat),lty=4,col="black",lwd=0.8) +
  labs(x="log2(fold change)",
       y="-log10 (p-value)")+
  theme_bw()+
  theme(plot.title = element_text(hjust = 0.5), 
        legend.position="right", 
        legend.title = element_blank()
  )
dev.off()

##繪制帶有基因名稱的火山圖
library(ggplot2) 
library(ggrepel)

cut_off_stat = 0.05 #設(shè)置統(tǒng)計值閾值
cut_off_logFC = 1 #設(shè)置表達量閾值,可修改
diff_res[is.na(diff_res)] <- 0
diff_res$change = ifelse(diff_res$pvalue < cut_off_stat & abs(diff_res$log2FoldChange) >= cut_off_logFC, 
                         ifelse(diff_res$log2FoldChange> cut_off_logFC ,'Up','Down'),
                         'Stable')
diff_res$label = ifelse(diff_res$padj < cut_off_stat & abs(diff_res$log2FoldChange) >= 4, as.character(diff_res$gene_id),"")
pdf("volcanol_gene.pdf")
ggplot(diff_res, 
       aes(x = log2FoldChange, 
           y = -log10(padj), 
           colour=change)) +
  geom_point(alpha=0.4, size=3.5) +
  scale_color_manual(values=c("#546de5", "#d2dae2","#ff4757"))+
  geom_vline(xintercept=c(-1,1),lty=4,col="black",lwd=0.8) +
  geom_hline(yintercept = -log10(cut_off_stat),lty=4,col="black",lwd=0.8) +
  labs(x="log2(fold change)",
       y="-log10 (FDR)")+
  theme_bw()+
  theme(plot.title = element_text(hjust = 0.5), 
        legend.position="right", 
        legend.title = element_blank()
  )+
  geom_text_repel(data = diff_res, aes(x = diff_res$log2FoldChange, 
                                      y = -log10(diff_res$padj), 
                                      label = label),
                  size = 3,box.padding = unit(0.8, "lines"),
                  point.padding = unit(0.8, "lines"), 
                  show.legend = FALSE)
dev.off()

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末减宣,一起剝皮案震驚了整個濱河市,隨后出現(xiàn)的幾起案子玩荠,更是在濱河造成了極大的恐慌漆腌,老刑警劉巖,帶你破解...
    沈念sama閱讀 206,839評論 6 482
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件阶冈,死亡現(xiàn)場離奇詭異闷尿,居然都是意外死亡,警方通過查閱死者的電腦和手機女坑,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 88,543評論 2 382
  • 文/潘曉璐 我一進店門填具,熙熙樓的掌柜王于貴愁眉苦臉地迎上來,“玉大人,你說我怎么就攤上這事劳景∮颍” “怎么了?”我有些...
    開封第一講書人閱讀 153,116評論 0 344
  • 文/不壞的土叔 我叫張陵盟广,是天一觀的道長闷串。 經(jīng)常有香客問我,道長筋量,這世上最難降的妖魔是什么烹吵? 我笑而不...
    開封第一講書人閱讀 55,371評論 1 279
  • 正文 為了忘掉前任,我火速辦了婚禮毛甲,結(jié)果婚禮上年叮,老公的妹妹穿的比我還像新娘。我一直安慰自己玻募,他們只是感情好,可當(dāng)我...
    茶點故事閱讀 64,384評論 5 374
  • 文/花漫 我一把揭開白布一姿。 她就那樣靜靜地躺著七咧,像睡著了一般。 火紅的嫁衣襯著肌膚如雪叮叹。 梳的紋絲不亂的頭發(fā)上艾栋,一...
    開封第一講書人閱讀 49,111評論 1 285
  • 那天,我揣著相機與錄音蛉顽,去河邊找鬼蝗砾。 笑死,一個胖子當(dāng)著我的面吹牛携冤,可吹牛的內(nèi)容都是我干的悼粮。 我是一名探鬼主播,決...
    沈念sama閱讀 38,416評論 3 400
  • 文/蒼蘭香墨 我猛地睜開眼曾棕,長吁一口氣:“原來是場噩夢啊……” “哼扣猫!你這毒婦竟也來了?” 一聲冷哼從身側(cè)響起翘地,我...
    開封第一講書人閱讀 37,053評論 0 259
  • 序言:老撾萬榮一對情侶失蹤申尤,失蹤者是張志新(化名)和其女友劉穎,沒想到半個月后衙耕,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體昧穿,經(jīng)...
    沈念sama閱讀 43,558評論 1 300
  • 正文 獨居荒郊野嶺守林人離奇死亡,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 36,007評論 2 325
  • 正文 我和宋清朗相戀三年橙喘,在試婚紗的時候發(fā)現(xiàn)自己被綠了时鸵。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點故事閱讀 38,117評論 1 334
  • 序言:一個原本活蹦亂跳的男人離奇死亡渴杆,死狀恐怖寥枝,靈堂內(nèi)的尸體忽然破棺而出宪塔,到底是詐尸還是另有隱情,我是刑警寧澤囊拜,帶...
    沈念sama閱讀 33,756評論 4 324
  • 正文 年R本政府宣布某筐,位于F島的核電站,受9級特大地震影響冠跷,放射性物質(zhì)發(fā)生泄漏南誊。R本人自食惡果不足惜,卻給世界環(huán)境...
    茶點故事閱讀 39,324評論 3 307
  • 文/蒙蒙 一蜜托、第九天 我趴在偏房一處隱蔽的房頂上張望抄囚。 院中可真熱鬧,春花似錦橄务、人聲如沸幔托。這莊子的主人今日做“春日...
    開封第一講書人閱讀 30,315評論 0 19
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽重挑。三九已至,卻和暖如春棠涮,著一層夾襖步出監(jiān)牢的瞬間谬哀,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 31,539評論 1 262
  • 我被黑心中介騙來泰國打工严肪, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留史煎,地道東北人。 一個月前我還...
    沈念sama閱讀 45,578評論 2 355
  • 正文 我出身青樓驳糯,卻偏偏與公主長得像篇梭,于是被迫代替她去往敵國和親。 傳聞我的和親對象是個殘疾皇子结窘,可洞房花燭夜當(dāng)晚...
    茶點故事閱讀 42,877評論 2 345

推薦閱讀更多精彩內(nèi)容