15
0
详细信息
国家基因组科学数据中心(NGDC),作为国家战略性科研平台,承担着推动我国基因组学研究的历史使命。NGDC于2019年由中国科学院北京基因组研究所牵头,联合多家科研单位共同建设,致力于生命与健康大数据汇交存储、安全管理、开放共享与整合挖掘,推动生命科学领域的发展。
NGDC 整合了丰富的数据库资源,涵盖了基因组学、转录组学、表观基因组学、单细胞组学、健康与疾病、植物及动物多样性等多个领域。

简单来说,NGDC既是一个“生命科学数据中心”,也是一个面向科研人员的“生物信息学服务平台”。它主要解决基因组及其他组学数据在科研活动中的存储、管理、汇交、共享和分析问题,服务对象包括高校、科研院所、医疗机构以及生物技术相关单位。
主要功能
NGDC不仅存储和管理数据,更通过整合和挖掘,形成了综合性的多组学数据库体系,支持精准医学等的研究与应用。 目前,NGDC部署的数据库资源包括原始数据、基因组和变异、基因表达、非编码 RNA、表观基因组、单细胞组学、生物多样性和生物合成、健康与疾病、文献和教育9大类101个。
- 科学数据汇交与保存:接收科研项目产生的基因组测序、基因变异、基因表达、蛋白质组、表观遗传组等数据,并为数据分配规范的公开编号。
- 数据管理与开放共享:按照相应标准对数据进行整理、归档和发布,使科研人员能够查询、下载和再利用相关数据。
- 数据库建设:建设覆盖原始组学数据、基因序列、基因组、遗传变异、生物样本、基因表达及多元生命科学数据的数据库体系。
- 数据检索与分析:提供跨数据库检索、BLAST序列比对和在线生物信息学分析工具,帮助科研人员从海量数据中发现有价值的信息。
- 标准规范与技术研究:开展生命科学数据标准、数据治理、计算生物学、生物信息学算法和大数据分析方法研究。
- 数据安全保障:为涉及人类遗传资源等敏感数据提供规范、安全的数据归档与受控访问机制,兼顾科研共享、数据安全和个人隐私保护。
代表性数据资源
原始数据数据库包括BioCode(生物信息学代码归档库)、BioProject(生物 项目数据库)、BioSample(生物样本数据库)、GSA(组学原始序列归档库)、GSA Human(组学原始数据归档库-人类遗传数据)、NODE(组学数据百科全书)等,致力于为全球科研人员提供高质量的数据存储、管理与共享服务。

- GSA(组学原始数据归档库):保存高通量测序等研究产生的原始组学数据。
- GSA-Human:用于人类遗传及组学数据的归档和受控共享。
- GenBase(基因序列库):提供核酸序列、注释信息及其编码蛋白质序列的汇交、查询和共享。
- GWH(基因组序列库):收录不同物种的基因组组装及注释数据。
- GVM(基因组变异库):保存和发布单核苷酸变异、插入缺失等基因组变异数据。
- BioProject与BioSample:分别记录科研项目及其生物样本的基本信息。
- OMIX(多元数据归档库):用于归档蛋白质组、代谢组、结构生物学、医学影像及其他类型的数据。
- Database Commons:汇集和整理国内外生物学数据库信息。

- BIT、BLAST和BIG Search:分别提供在线生物信息学分析、序列比对和跨数据库检索服务。
随机推荐