linux BLAST序列比對

安裝本地blast序列比對軟件拱雏,我們可以搜索一個查詢序列定制數(shù)據(jù)庫,例如想研究一個新測序的基因組气破,或者感興趣的一組蛋白質(zhì)序列济锄。有時我們希望把程序插入到一個流程中,例如搜索一個大量的查詢序列霍转,例如你的測序數(shù)據(jù)含有大量的污染片段荐绝,你想知道這些片段比對到了什么物種。

blast軟件安裝

從NCBI下載安裝包https://ftp.ncbi.nlm.nih.gov/blast/executables/blast+/LATEST/避消。下載2.11.0 linux版本低滩,下載并解壓,解壓之后BLAST就安裝好了岩喷。用戶需要設(shè)置環(huán)境變量恕沫,目的是為了告訴系統(tǒng)在那里可以找到安裝好的BLAST軟件。

wget https://ftp.ncbi.nlm.nih.gov/blast/executables/blast+/LATEST/ncbi-blast-2.12.0+-x64-linux.tar.gz
wget https://ftp.ncbi.nlm.nih.gov/blast/executables/blast+/LATEST/ncbi-blast-2.12.0+-x64-linux.tar.gz.md5

md5sum -c ncbi-blast-2.12.0+-x64-linux.tar.gz.md5
tar -zxvf ncbi-blast-2.12.0+-x64-linux.tar.gz
#加入到環(huán)境變量
export PATH=$PATH:$PWD/ncbi-blast-2.11.0+/bin
source ~/.bashrc

一纱意、 nt/nr fasta下載

從NCBI(ftp://ftp.ncbi.nlm.nih.gov/blast/db/FASTA/
)下載nt婶溯、nr fasta文件。

wget ftp://ftp.ncbi.nlm.nih.gov/blast/db/FASTA/nt.gz
wget ftp://ftp.ncbi.nlm.nih.gov/blast/db/FASTA/nr.gz
wget ftp://ftp.ncbi.nlm.nih.gov/blast/db/FASTA/nt.gz.md5
wget ftp://ftp.ncbi.nlm.nih.gov/blast/db/FASTA/nr.gz.md5
md5sum -c nt.gz.md5
md5sum -c nr.gz.md5
tar -xzvf nr.gz
tar -xzvf nt.gz

mkdir nr_db
mkdir nt_db
makeblastdb -in nr -dbtype prot -title make_nr -parse_seqids -out ./nr_db/nr -logfile make_nr.log
makeblastdb -in nt -dbtype nucl -title make_nt -parse_seqids -out ./nt_db/nt -logfile make_nt.log

或者使用NCBI處理好的db偷霉。
wget -c ftp://ftp.ncbi.nlm.nih.gov/blast/db/nt*
wget -c ftp://ftp.ncbi.nlm.nih.gov/blast/db/nr*

序列比對

  • blastp:蛋白序列與蛋白庫作比對迄委,直接比對蛋白序列的同源性。
  • blastx:核酸序列與蛋白庫作比對类少,將核酸序列先翻譯成蛋白序列叙身,再將其與蛋白庫作比對。
    -blastn:核酸序列與核酸庫的比對硫狞,直接比對核酸序列的同源性信轿。
  • tblastn:蛋白序列對核算庫的比對,現(xiàn)將核酸庫翻譯成蛋白庫残吩,再將蛋白序列與翻譯后的蛋白庫進行比對财忽。
  • tblastx:核酸與核酸數(shù)據(jù)庫在蛋白質(zhì)水平比較

如果是fastq先轉(zhuǎn)為fasta序列格式在進行比對,比對結(jié)果如下圖1所示世剖。將相同序列復制到NCBI網(wǎng)站進行比對定罢,如下圖2,兩種結(jié)果最前面的比對條目基本一致旁瘫。

awk '{if(NR%4 == 1){print ">" substr($0, 2)}}{if(NR%4 == 2){print}}' test.fastq > test.fasta
blastn -query test.fasta -out test.result -db ./nt_db/nt 

image
image

使用NCBI網(wǎng)站下載的db進行比對祖凫。

wget -c ftp://ftp.ncbi.nlm.nih.gov/blast/db/nr*

for i in `ls nt_db_NCBI/*gz`do;tar -zxvf $i;done
## 輸出一條最優(yōu)比對結(jié)果
blastn -query test1.fa -out test1.align -db ./nt_db_NCBI/nt -outfmt 6 -subject_besthit -num_threads 4

二琼蚯、通過blast在基因組中找相似序列

1. 建立比對數(shù)據(jù)庫

makeblastdb -in cavia.fa -dbtype nucl -parse_seqids -out caviaDatabase

2. blast比對

blastn -query hsa_MT.fasta -out query.align -db caviaDatabase -outfmt 6 -subject_besthit -num_threads 4

3. 比對結(jié)果如下

image

格式說明:

Query id, Subject id, % identity, alignment length, mismatches, gap openings, q. start, q. end惠况, s. start遭庶, s. end, e-value稠屠, bit score

轉(zhuǎn)載來自:
作者:生信汪 鏈接:http://www.reibang.com/p/03ef69ef0d79
作者:像鳥一樣飛過你的高山 鏈接:http://www.reibang.com/p/471a4fbcdd48

?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末峦睡,一起剝皮案震驚了整個濱河市,隨后出現(xiàn)的幾起案子权埠,更是在濱河造成了極大的恐慌榨了,老刑警劉巖,帶你破解...
    沈念sama閱讀 219,366評論 6 508
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件攘蔽,死亡現(xiàn)場離奇詭異龙屉,居然都是意外死亡,警方通過查閱死者的電腦和手機满俗,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 93,521評論 3 395
  • 文/潘曉璐 我一進店門转捕,熙熙樓的掌柜王于貴愁眉苦臉地迎上來,“玉大人唆垃,你說我怎么就攤上這事五芝。” “怎么了辕万?”我有些...
    開封第一講書人閱讀 165,689評論 0 356
  • 文/不壞的土叔 我叫張陵枢步,是天一觀的道長。 經(jīng)常有香客問我渐尿,道長价捧,這世上最難降的妖魔是什么? 我笑而不...
    開封第一講書人閱讀 58,925評論 1 295
  • 正文 為了忘掉前任涡戳,我火速辦了婚禮结蟋,結(jié)果婚禮上,老公的妹妹穿的比我還像新娘渔彰。我一直安慰自己嵌屎,他們只是感情好,可當我...
    茶點故事閱讀 67,942評論 6 392
  • 文/花漫 我一把揭開白布恍涂。 她就那樣靜靜地躺著宝惰,像睡著了一般。 火紅的嫁衣襯著肌膚如雪再沧。 梳的紋絲不亂的頭發(fā)上尼夺,一...
    開封第一講書人閱讀 51,727評論 1 305
  • 那天,我揣著相機與錄音,去河邊找鬼淤堵。 笑死寝衫,一個胖子當著我的面吹牛,可吹牛的內(nèi)容都是我干的拐邪。 我是一名探鬼主播慰毅,決...
    沈念sama閱讀 40,447評論 3 420
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼扎阶!你這毒婦竟也來了汹胃?” 一聲冷哼從身側(cè)響起,我...
    開封第一講書人閱讀 39,349評論 0 276
  • 序言:老撾萬榮一對情侶失蹤东臀,失蹤者是張志新(化名)和其女友劉穎着饥,沒想到半個月后,有當?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體惰赋,經(jīng)...
    沈念sama閱讀 45,820評論 1 317
  • 正文 獨居荒郊野嶺守林人離奇死亡贱勃,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 37,990評論 3 337
  • 正文 我和宋清朗相戀三年,在試婚紗的時候發(fā)現(xiàn)自己被綠了谤逼。 大學時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片。...
    茶點故事閱讀 40,127評論 1 351
  • 序言:一個原本活蹦亂跳的男人離奇死亡仇穗,死狀恐怖流部,靈堂內(nèi)的尸體忽然破棺而出,到底是詐尸還是另有隱情纹坐,我是刑警寧澤枝冀,帶...
    沈念sama閱讀 35,812評論 5 346
  • 正文 年R本政府宣布,位于F島的核電站耘子,受9級特大地震影響果漾,放射性物質(zhì)發(fā)生泄漏。R本人自食惡果不足惜谷誓,卻給世界環(huán)境...
    茶點故事閱讀 41,471評論 3 331
  • 文/蒙蒙 一绒障、第九天 我趴在偏房一處隱蔽的房頂上張望。 院中可真熱鬧捍歪,春花似錦户辱、人聲如沸。這莊子的主人今日做“春日...
    開封第一講書人閱讀 32,017評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽。三九已至变逃,卻和暖如春必逆,著一層夾襖步出監(jiān)牢的瞬間,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 33,142評論 1 272
  • 我被黑心中介騙來泰國打工名眉, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留粟矿,地道東北人。 一個月前我還...
    沈念sama閱讀 48,388評論 3 373
  • 正文 我出身青樓璧针,卻偏偏與公主長得像嚷炉,于是被迫代替她去往敵國和親。 傳聞我的和親對象是個殘疾皇子探橱,可洞房花燭夜當晚...
    茶點故事閱讀 45,066評論 2 355

推薦閱讀更多精彩內(nèi)容