写在前面
基因组测序项目已然是几乎所有课题组都可以负担的水平。相比于几年前火爆的通过转录组测序挖掘生物学问题策略,通过基因组,尤其是比较基因组分析,往往可以给我们带来更多确定性结果,如相比于近源物种A为何物种B的果皮更红?这完全有可能是特定家族成员扩张导致。这些问题,转录组常常无法告诉我们,而基因组可以。接下来推出两份教程,来自课题组成员的投稿。我个人感觉还不错。与大伙一起学习。
同源基因分析介绍
开展生物信息数据分析的关键,并不在于软件使用,而在于了解自己在做什么。我们先厘清一些概念。
Q:什么是同源基因?
A:同源基因(homologs)主要分为直系同源(orthologs)和旁系同源(paralogs)。在远古时候,祖先物种只带有一个珠蛋白基因(early globin genes),经过N年的环境选择,现存的物种都具有两个珠蛋白基因,分别为α-链和β-链的类型。青蛙-人类-鼠的α-链球蛋白基因,三个并称为直系同源基因,而蛙的α链和β链球蛋白基因则称作旁系同源基因。
Q: 同源基因分析可以做什么?
A: 较短时间下,获得同源基因集合(Orthogroups)和 有根物种树(基于Orthogroups内基因推断的)的信息。具有这些信息,后续可以