巨坑!基因家族鉴定/分析,基因功能研究,一步之差,努力白费!

写在前面

不知为何,几乎每天我都会收到一些「基因家族分析」的论文审稿邀请,其中质量参差不齐,但有不少论文作者团队非常友好,总是留下一个非常好提问机会。那就是「基因家族成员序列有问题」这意味着,得重做。对于一个以「基因家族分析」为主题的工作来说,往往相关表格和图片都得重新来。如果不小心,用了错误的基因序列做功能验证,那更是白费一年时间。
当然,对于审稿人不小心的情况,也比比皆是。简单通过 google scholar 搜索,可以很快找到一大堆已发表的论文,从主图来看,有经验的审稿人一眼就看出问题。这个错误的责任,20%归结于发布基因组的人,更有80%归结于进行基因家族鉴定工作的人。后者,我觉得还是要精细一些。

几个示例


上图由于串联重复基因被注释成一个,从 motifs pattern 就可以看出来问题。图片得重做,表格得更新!

上图由于注释错误,应该是将近端的基因注释成UTR,图片得重做,表格得更新!

上图将近邻的基因直接注释成ORF,所以导致超长CDS。图片得重做,表格得更新!

如上,超长UTR

串联重复或者近邻基因被注释进来的。

上图讲近邻的基因直接注释成ORF,所以导致超长CDS。图片得重做,表格得更新!

明显缺胳膊少腿,注释问题。

处理问题

对于这类基因结构注释错误,如何处理?我记得 5 年前,类似情况发文占比可能更高的一些。我一直在提议也强调这个问题值得重视:

  1. 对于做基因组的朋友来说,高质量的序列要高质量的注释才是高质量的参考;
  2. 对于做基因功能研究的朋友来说,错误的注释可能会直接让数年努力白费;
  3. 对于做基因家族分析的朋友来说,还是要精细一点,做一点可能的贡献。

这五年来,为了应对这一问题,我大体分成三个阶段给出解决办法:

  1. 开发了 TBtools 的 Re-construct GXF ,这一功能可以基于用户输入的转录本序列和参考基因组序列,自动生成一个借用的GXF,我相信我提出来的时候,应该没啥人去注意这个事情,至少没有人让这个事情变得如此简单。当然,我必须说明,北大高歌老师的GSDSv2网站内部应是有做一些处理完成这个工作。有了这个功能,用户完全可以基于区间预测CDS或者EXON结构,得到序列后重构。稍显麻烦,后期利用GXF也比较麻烦;
  2. 开发了 IGV-GSAme (Gene Structure Annotation Manual Editor),基于IGV源码重度开发的版本,这一版本事实上是基于前述我写的 IGV-sRNA。使用这一版本,用户可以直接对 IGV 的 GXF Track 进行基因结构注释调整。说实话,这个修改直接让我不想再看到 IGV-sRNA 和 IGV-GSAme,因为修改后感觉已经把 IGV 改得乱七八糟。用起来完全没什么,但是真的很奇怪,我总觉得哪里会出问题,同时改造结果不在我的控制范围内。
  3. 开发了 IGV-GSAman(Gene Structure Annotation Manipulator),同样是基于 IGV 源码改造,不过这次的改造我很满意。这个改造其实是基于第二次 IGV-sRNA 来写的(IGV-sRNA也是重新开发,只是觉得没必要增加一个v2,我觉得前后没啥区别,实现逻辑有很大优化,仅此而已)。GSAman 不同,他跟 GSAme 完全是不同的东西。自然,本身GSAman其实....是一个简单的功能或者特性开发尝试,我只是想试试能不能在 IGV 里面加一个自定义的 Track,但是没想到真干成了.....

于是现在有了 IGV-GSAman,他可以帮助几乎所有人解决「基因结构注释偏差」的问题。



更多特性,推荐大伙参考 GSAman Cookbook。说实话,真的很强!

欢迎了解基因结构注释人工矫正软件 GSAman,目前软件未发表,处于内测阶段,有需要可以 参考文档操作,进内测群获取下载链接,《GSAman Cookbook》: https://www.yuque.com/cjchen/ra7ghy

写在最后

我从未做过一个基因家族分析的论文,但可能我审过基因分析论文有太多。我仍然不太希望有朋友因为这类简单的偏差,导致半年一年的东西要从头再来。对于基因功能研究的朋友,更是如此。
如果我们从一开始就做对,那或许路子就没那么坎坷~

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 199,902评论 5 468
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 84,037评论 2 377
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 146,978评论 0 332
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 53,867评论 1 272
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 62,763评论 5 360
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 48,104评论 1 277
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 37,565评论 3 390
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 36,236评论 0 254
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 40,379评论 1 294
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 35,313评论 2 317
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 37,363评论 1 329
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 33,034评论 3 315
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 38,637评论 3 303
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 29,719评论 0 19
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 30,952评论 1 255
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 42,371评论 2 346
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 41,948评论 2 341

推荐阅读更多精彩内容