基因家族 基于 blast比對 篩選串聯(lián)重復基因

#定義%identity>70并且aligment length>70 認為是串聯(lián)重復基因
makeblastdb -in bhlh.cds -dbtype nucl -title bhlh
blastn -num_threads 24 -db bhlh.cds -query bhlh.cds -evalue 1e-20 -outfmt 7 >blastn.out
samtools faidx bhlh.cds

vi  KAKS_SHAIXUAN.pl 
use Getopt::Long;
my %opts;
use Data::Dumper;
GetOptions (\%opts,"in1=s","in2=s","out=s","h"); 
if (! defined($opts{in1}) ||! defined($opts{in2})||! defined($opts{out}) || defined($opts{h})){
    &USAGE;
}
open (IN1,"$opts{in1}") || die "open $opts{in} failed\n";
open (IN2,"$opts{in2}") || die "open $opts{ina} failed\n";
open (OUT,">$opts{out}") || die "open $opts{out} failed\n";
 my %cds_length;
while(<IN1>){
    chomp;
    my @line = split("\t",$_);
    $cds_length{$line[0]}= $line[1];
    #print "$cds_length{$line[0]}\n";
} 

while( <IN2>){
    
        chomp($_);
        my @line1 = split ("\t",$_);
        #print @line1;
        #print "\n";
        my $max_length = $cds_length{$line1[0]} > $cds_length{$line1[1]} ? $cds_length{$line1[0]}:$cds_length{$line1[1]};
        if(($line1[0] ne $line1[1]) && ($line1[2] > 70 )&& ($line1[3] > 0.70*$max_length)){
            print OUT $_."\t$max_length\n";
        
        }
        #print $cds_length1{$line1[0]};
    
}


close(IN1);
close(IN2);
close(OUT);
sub USAGE {
       print "usage: perl $0 -in1 cds_length   -in2 result.txt -out shaixuan_result.txt";
    exit;
}

perl  KAKS_SHAIXUAN.pl -in1 bhlh.cds.fai -in2 blastn.out -out shaixuan.result

vi gettangm.pl
#!/usr/bin/perl -w
use strict;
my %hash;
open IN, "shaixuan.result";
open OU, ">test.txt1";
while(<IN>){
        chomp;
        my @line=split/\s+/,$_;
        my $a=shift@line;
        my $b=shift@line;
        my @n=($a,$b);
        my @h = sort(@n);
        my $l="@h";
        $l=~s/\s/\t/g;
        next if exists $hash{$l};
        $hash{$l}= 1;
        print OU "$l\n";

}
perl   gettangm.pl   
得到test.txt1 即是串聯(lián)重復ID 后面就可以用MCSCAN畫圖 
在 .anchors.simple里面對串聯(lián)基因上色即可
最后編輯于
?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末境肾,一起剝皮案震驚了整個濱河市,隨后出現(xiàn)的幾起案子磕瓷,更是在濱河造成了極大的恐慌臀栈,老刑警劉巖信轿,帶你破解...
    沈念sama閱讀 206,839評論 6 482
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件吴趴,死亡現(xiàn)場離奇詭異躏哩,居然都是意外死亡岩瘦,警方通過查閱死者的電腦和手機,發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 88,543評論 2 382
  • 文/潘曉璐 我一進店門唇敞,熙熙樓的掌柜王于貴愁眉苦臉地迎上來蔗草,“玉大人,你說我怎么就攤上這事疆柔≈渚” “怎么了?”我有些...
    開封第一講書人閱讀 153,116評論 0 344
  • 文/不壞的土叔 我叫張陵旷档,是天一觀的道長模叙。 經(jīng)常有香客問我,道長鞋屈,這世上最難降的妖魔是什么范咨? 我笑而不...
    開封第一講書人閱讀 55,371評論 1 279
  • 正文 為了忘掉前任,我火速辦了婚禮厂庇,結(jié)果婚禮上渠啊,老公的妹妹穿的比我還像新娘。我一直安慰自己宋列,他們只是感情好昭抒,可當我...
    茶點故事閱讀 64,384評論 5 374
  • 文/花漫 我一把揭開白布。 她就那樣靜靜地躺著炼杖,像睡著了一般灭返。 火紅的嫁衣襯著肌膚如雪。 梳的紋絲不亂的頭發(fā)上坤邪,一...
    開封第一講書人閱讀 49,111評論 1 285
  • 那天熙含,我揣著相機與錄音,去河邊找鬼艇纺。 笑死怎静,一個胖子當著我的面吹牛,可吹牛的內(nèi)容都是我干的黔衡。 我是一名探鬼主播蚓聘,決...
    沈念sama閱讀 38,416評論 3 400
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼盟劫!你這毒婦竟也來了夜牡?” 一聲冷哼從身側(cè)響起,我...
    開封第一講書人閱讀 37,053評論 0 259
  • 序言:老撾萬榮一對情侶失蹤侣签,失蹤者是張志新(化名)和其女友劉穎塘装,沒想到半個月后急迂,有當?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體,經(jīng)...
    沈念sama閱讀 43,558評論 1 300
  • 正文 獨居荒郊野嶺守林人離奇死亡蹦肴,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點故事閱讀 36,007評論 2 325
  • 正文 我和宋清朗相戀三年僚碎,在試婚紗的時候發(fā)現(xiàn)自己被綠了。 大學時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片阴幌。...
    茶點故事閱讀 38,117評論 1 334
  • 序言:一個原本活蹦亂跳的男人離奇死亡勺阐,死狀恐怖,靈堂內(nèi)的尸體忽然破棺而出裂七,到底是詐尸還是另有隱情皆看,我是刑警寧澤,帶...
    沈念sama閱讀 33,756評論 4 324
  • 正文 年R本政府宣布背零,位于F島的核電站,受9級特大地震影響无埃,放射性物質(zhì)發(fā)生泄漏徙瓶。R本人自食惡果不足惜,卻給世界環(huán)境...
    茶點故事閱讀 39,324評論 3 307
  • 文/蒙蒙 一嫉称、第九天 我趴在偏房一處隱蔽的房頂上張望侦镇。 院中可真熱鬧,春花似錦织阅、人聲如沸壳繁。這莊子的主人今日做“春日...
    開封第一講書人閱讀 30,315評論 0 19
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽闹炉。三九已至,卻和暖如春润樱,著一層夾襖步出監(jiān)牢的瞬間渣触,已是汗流浹背。 一陣腳步聲響...
    開封第一講書人閱讀 31,539評論 1 262
  • 我被黑心中介騙來泰國打工壹若, 沒想到剛下飛機就差點兒被人妖公主榨干…… 1. 我叫王不留嗅钻,地道東北人。 一個月前我還...
    沈念sama閱讀 45,578評論 2 355
  • 正文 我出身青樓店展,卻偏偏與公主長得像养篓,于是被迫代替她去往敵國和親。 傳聞我的和親對象是個殘疾皇子赂蕴,可洞房花燭夜當晚...
    茶點故事閱讀 42,877評論 2 345