北京基因组所(国度生物信息中心)开发分子序列组分动态图谱数据库CompoDynamics
生物体的核酸与蛋白质分子的序列组分及有关特点(如GC/AG含量、密码子使用偏好、蛋白质物理化学性质等)对于钻研基因职能和物种演化拥有沉要意思,是理解分歧物种、分歧基因家族以及分歧职能基因之间差距的数据基础。
近日,由GA黄金甲(国度生物信息中心)国度基因组科学数据中心开发的分子序列组分动态图谱数据库CompoDynamics正式上线,旨在对序列组分的动态变动提供综合、全面的展示,以多物种的系统性比力分析为基础,为深刻的分子演化钻研提供沉要的参考和启迪。该钻研成就以 “CompoDynamics: a comprehensive database for characterizing sequence composition dynamics”为题在国际学术期刊Nucleic Acids Research 在线颁发。
CompoDynamics针对RefSeq数据库的基因组注解信息,别离推算分析了基因和基因组层面的3类序列组分特点(碱基组成、密码子使用偏好、氨基酸组成)和3类有关序列特点(编码潜能、蛋白物理化学性质、相分离个性)。目前,CompoDynamics共蕴含24,995个物种、34,562个基因组、1,692,647个基因,以及118,689,747条盛开读码框序列。每条序列或每个基因组均有专门页面对各项特点进行详尽展示,并在主页以组分/特点分类展示。用户可通过物种分类、物种名、装配号、基因序列号、蛋白名称等进行检索。此表,CompoDynamics还提供了SpeciesComparator、FamilyComparator、GOComparator和CompoAnalyzer 4个在线比力分析工具,别离用于物种间、基因家族间、基因职能层面的各项组分/特点比力分析,支持对用户提供序列的推算分析,推进多组分特点和多维度的分子演化钻研。
北京基因组所(国度生物信息中心)助理钻研员降帅、硕士钻研生杜强和冯昶瑞为本文共同第一作者,马利娜副钻研员与章张钻研员为共同通讯作者。该钻研得到了科技部、中科院战术性先导科技专项、国度天然科学基金委、中科院青促会项目赞助。
论文链接

CompoDynamics数据库内容与结构






