blast与blast+使用(参数、输出文件格式)

一、BLAST+(NCBI发布于2009年)

下载地址:https://ftp.ncbi.nlm.nih.gov/blast/executables/blast+/LATEST/

1、建库

makeblastdb -in db.fasta -dbtype prot -out dbname

参数说明
-in:待格式化的序列文件
-dbtype:数据库类型,prot或nucl
-out:数据库名
-parse_seqids:解析序列标识(建议加上)
-out:数据库名
-title:数据库名(略)
-logfile:日志文件,默认输出到屏幕
更多参数 makeblastdb -help
2、比对

blastp -query seq.fasta -out seq.blast -db dbname -outfmt 6 -evalue 1e-5 -num_threads 4

参数说明
-query: 输入文件路径及文件名
-out:输出文件路径及文件名
-db:格式化了的数据库路径及数据库名
-outfmt:输出文件格式,总共有12种格式,6是tabular格式对应之前BLAST的m8格式
-evalue:设置输出结果的e-value值
-num_alignments 显示比对数Default = 250
-num_descriptions:单行描述的最大数目 default=50
-num_threads:线程数
更多参数 blastp -help

3、核酸序列比对核酸数据库(blastn)以及核酸序列比对蛋白数据库(blastx)

blastn -query seq.fasta -out seq.blast -db dbname -outfmt 6 -evalue 1e-5 -num_threads 4
blastx -query seq.fasta -out seq.blast -db dbname -outfmt 6 -evalue 1e-5 -num_threads 4

4、文件格式
重点是-outfmt 6,也就是之前版本的m 8格式
结果中从左到右每一列的意义分别是:

Query_id    Subject_id   %_identity alignment_length   mismatches   gap_openings  q. start  q. end   s. start   s. end   e-value  bit_score
AKS24976.1  ABU86350.1  25.446  224 149 9   713 931 2   212 3.23e-05    38.1
AKS24976.1  ABU86150.1  38.596  57  34  1   599 655 16  71  8.09e-05    36.6
AKS24976.1  ABU86161.1  38.667  75  42  2   578 652 14  84  9.06e-05    37.0
AKS24976.1  ABU86160.1  38.667  75  42  2   578 652 14  84  9.06e-05    37.0
AKS24976.1  ABU86162.1  38.667  75  42  2   578 652 14  84  9.31e-05    37.0
AKS24976.1  ABU86154.1  38.596  57  34  1   599 655 16  71  9.70e-05    36.6
AKS24976.1  ABU86152.1  38.596  57  34  1   599 655 16  71  9.70e-05    36.6
AKS24976.1  ABU86329.1  39.130  69  38  2   599 664 83  150 2.51e-04    34.7
AKS24976.1  ABU86326.1  39.130  69  38  2   599 664 83  150 2.51e-04    34.7
AKS24976.1  ABU86325.1  39.130  69  38  2   599 664 83  150 2.51e-04    34.7

二、blast

1、建库

formatdb -i db.seq -p T -o T -l logfile

主要参数:
-i 输入需要格式化的源数据库名称
-p 文件类型,是核苷酸序列数据库(F - nucleotide)/蛋白质序列数据库(T – protein),default = T
-a 输入数据库的格式是否为ASN.1/FASTA [T/F],default = F
-o 解析选项:解析序列标识并且建立目录[T/F],default = F
-l 自定义log文件命令default=formatdb.log,记录运行时间、版本号、序列数目等
-n 自定义库文件命名
建库结果:
如果建立的是核酸库,输出为db.seq.nhr、db.seq.nin、db.seq.nsq三个文件,若选择了“-o T”,还会同时输出db.seq.nsd、db.seq.nsi、db.seq.nni、db.seq.nnd四个文件,一共七个。
蛋白库和核酸库的输出类似,相应的输出文件为:db.seq.nhr、db.seq.nin、db.seq.nsq和db.seq.nsd、db.seq.nsi、db.seq.nni、db.seq.nnd七个文件。
2、比对

blastall -i seq.fa -d db.fa -o blast.out -p blastp -F F -m 8 -e 1e-5 -b 10 -v 10 -a 2

主要参数:
以上流程中所用参数:
-i 所用查询序列文件
-d 所用序列数据库的名称 default=nr
-o BLAST结果的输出文件
-p 所用程序名称: blastn,blastp,blastx,tblastn,tblastx
-F 查询序列过滤:将那些给出影响比对结果的低复杂度区域过滤掉 default = T
-m 比对结果显示格式 defalut=0
-e 期望值,描述搜索某一特定数据库时,随机出现的匹配序列数目default = 10.0
-b 显示比对结果的最大数目 default=250
-v 单行描述的最大数目 default=500
-a 使用处理器的数目 default = 1(单机)

-m 比对结果格式选项:

1 = query-anchored showing identities,查询-比上区域,显示一致性
2 = query-anchored no identities,查询-比上区域,不显示一致性
3 = flat query-anchored, show identities,查询-比上区域的屏文形式,显示一致性
4 = flat query-anchored, no identities,查询-比上区域的屏文形式,不显示一致性
5 = query-anchored no identities and blunt ends,查询-比上区域,不显示一致性,无突然的结束
6 = flat query-anchored, no identities and blunt ends,查询-比上区域的屏文形式,不显示一致性
7 = XML Blast output,XML格式的输出
8 = tabular,TAB格式的输出
9 =tabular with comment lines,带注释行的TAB格式的输出
10 =ASN, text,文本方式的ASN格式输出
11 =ASN, binary [Integer] default = 0,二进制方式的ASN格式输出

m8格式12列结果:

Query id, Subject id, % identity, alignment length, mismatches, gap openings, q.start, q.end, s.start, s.end, e-value, bit score
第一列为Query(递交序列),
第二列为数据库序列(目标序列subejct),
第三列为: identity
第四列为:比对长度
第五列为:错配数
第六列为:gap数
第七列和第八列为:Query开始碱基位置和结束碱基位置
第九列和第十列为:Subject开始碱基位置和结束碱基位置
第十一列为:期望值
第十二列为:比对得分

参考:
https://www.jianshu.com/p/2c4c53b74594 --->三种比对方式
http://blog.sciencenet.cn/blog-299308-1142875.html --->详细格式

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 203,547评论 6 477
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 85,399评论 2 381
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 150,428评论 0 337
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 54,599评论 1 274
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 63,612评论 5 365
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 48,577评论 1 281
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 37,941评论 3 395
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 36,603评论 0 258
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 40,852评论 1 297
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 35,605评论 2 321
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 37,693评论 1 329
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 33,375评论 4 318
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 38,955评论 3 307
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 29,936评论 0 19
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 31,172评论 1 259
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 43,970评论 2 349
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 42,414评论 2 342

推荐阅读更多精彩内容