资源与平台

生命与健康大数据中心资源

展开
  • 1. 中国科学院北京基因组研究所,生命与健康大数据中心,北京 100101
    2. 中国科学院北京基因组研究所,中国科学院基因组科学与信息重点实验室,北京 100101
    3. 中国科学院大学,北京 100049
张源笙,硕士研究生,专业方向:生物信息学。E-mail: zhangyuansheng@big.ac.cn|夏琳,博士研究生,专业方向:生物信息学。E-mail: xialin@big.ac.cn|桑健,博士研究生,专业方向:生物信息学。E-mail: sangj@big.ac.cn 张源笙、夏琳和桑健并列第一作者。

收稿日期: 2018-07-05

  修回日期: 2018-09-12

  网络出版日期: 2018-09-18

基金资助

中国科学院战略性先导科技专项(XDA19050302);中国科学院战略性先导科技专项(XDB13040500);中国科学院战略性先导科技专项(XDA08020102);国家重点研发计划(2016YFC0901603);中国科学院“十三五”信息化建设专项(XXH13505-05)

The BIG Data Center’s database resources

Expand
  • 1. BIG Data Center, Beijing Institute of Genomics, Chinese Academy of Sciences, Beijing 100101, China
    2. CAS Key Laboratory of Genomics and Information, Beijing Institute of Genomics, Chinese Academy of Sciences, Beijing 100101, China
    3. University of Chinese Academy of Sciences, Beijing 100049, China

Received date: 2018-07-05

  Revised date: 2018-09-12

  Online published: 2018-09-18

Supported by

Supported by Strategic Priority Research Program of the Chinese Academy of Sciences(XDA19050302);Supported by Strategic Priority Research Program of the Chinese Academy of Sciences(XDB13040500);Supported by Strategic Priority Research Program of the Chinese Academy of Sciences(XDA08020102);the National Key Research & Development Program of China(2016YFC0901603);the 13th Five-year Informatization Plan of Chinese Academy of Sciences(XXH13505-05)

摘要

生命与健康多组学数据是生命科学研究和生物医学技术发展的重要基础。然而,我国缺乏生物数据管理和共享平台,不但无法满足国内日益增长的生物医学及相关学科领域的研究发展需求,而且严重制约我国生物大数据整合共享与转化利用。鉴于此,中国科学院北京基因组研究所于2016年初成立生命与健康大数据中心(BIG Data Center, BIGD),围绕国家人口健康和重要战略生物资源,建立生物大数据管理平台和多组学数据资源体系。本文重点介绍BIGD的生命与健康大数据资源系统,主要包括组学原始数据归档库、基因组数据库、基因组变异数据库、基因表达数据库、甲基化数据库、生物信息工具库和生命科学维基知识库,提供生物大数据汇交、整合与共享服务,为促进我国生命科学数据管理、推动国家生物信息中心建设奠定重要基础。

本文引用格式

张源笙,夏琳,桑健,李漫,刘琳,李萌伟,牛广艺,曹佳宝,滕徐菲,周晴,章张 . 生命与健康大数据中心资源[J]. 遗传, 2018 , 40(11) : 1039 -1043 . DOI: 10.16288/j.yczz.18-190

Abstract

Omics data in life and health sciences are of fundamental significance for scientific research and biomedical technology development. However, there is yet to be a platform for biological data management and sharing in China, making it difficult to meet the development needs of biomedical and related fields and consequently leading to severe issues in big data management, sharing and translation. To address these issues, Beijing Institute of Genomics (BIG) of Chinese Academy of Sciences founded the BIG Data Center (BIGD) in 2016, which is dedicated to establish a biological big data management platform and multi-omics databases, with a particular focus on national population healthcare and important strategic biological resources. In this paper, we describe core database resources in BIGD, including GSA (Genome Sequence Archive), GWH (Genome Warehouse), GVM (Genome Variation Map), GEN (Gene Expression Nebulas), MethBank (Methylation Bank), BioCode and Science Wikis. Taken together, all these resources provide a series of services for data deposition, integration and sharing, laying solid foundations for enhancing national biological science data management and further promoting the construction of national bioinformatics center.

参考文献

[1] BIG Data Center Members . The BIG Data Center: from deposition to integration to translation. Nucleic Acids Res, 2017,45(Database Issue):D18-D24.
[2] BIG Data Center Members . Database resources of the BIG Data Center in 2018. Nucleic Acids Res, 2018,46(Database Issue):D14-D20.
[3] Wang Y, Song F, Zhu J, Zhang S, Yang Y, Chen T, Tang B, Dong L, Ding N, Zhang Q, Bai Z, Dong X, Chen H, Sun M, Zhai S, Sun Y, Yu L, Lan L, Xiao J, Fang X, Lei H, Zhang Z, Zhao W . GSA: Genome sequence archive. Genom Proteom Bioinf, 2017,15(1):14-18.
[4] Zhang S, Chen T. Zhu J, Zhou Q, Chen X, Wang Y, Zhao W . GSA: Genome Sequence Archive. Hereditas (Beijing), 2018,40(11):1044-1047.
[4] 张思思, 陈婷婷, 朱军伟, 周晴, 陈旭, 王彦青, 赵文明 . GSA: 组学原始数据归档库. 遗传, 2018,40(11):1044-1047.
[5] Song S, Tian D, Li C, Tang B, Dong L, Xiao J, Bao Y, Zhao W, He H, Zhang Z . Genome Variation Map: a data repository of genome variations in BIG Data Center. Nucleic Acids Res, 2018,46(Database Issue):D944-D949.
[6] Song S, Teng X, Xiao J . Database resources of the reference genome and genetic varia-tion maps for the Chinese population. Hereditas (Beijing), 2018,40(11):1048-1054.
[6] 宋述慧, 滕徐菲, 肖景发 . 中国人群参考基因组及基因组变异图谱资源库. 遗传, 2018,40(11):1048-1054.
[7] Ling Y, Jin Z, Su M, Zhong J, Zhao Y, Yu J, Wu J, Xiao J . VCGDB: a dynamic genome database of the Chinese population. BMC Genomics, 2014,15:265.
[8] Bai B, Zhao W, Tang B, Wang Y, Wang L, Zhang Z, Yang H, Liu Y, Zhu J, Irwin D, Wang G, Zhang Y . DoGSD: the dog and wolf genome SNP database. Nucleic Acids Res, 2015,43(Database Issue):D777-D783.
[9] Luo H, Zhao W, Wang Y, Xia Y, Wu X, Zhang L, Tang B, Zhu J, Fang L, Du Z, Bekele W, Tai S, Jordan D, Godwin I, Snowdon R, Mace E, Jing H, Luo J . SorGSD: a sorghum genome SNP database. Biotechnol Biofuel, 2016,9(1):6.
[10] Sheng X, Wu J, Sun Q, Xian F, Li X, Sun M, Fang W, Chen M, Yu J, Xiao J . MTD: a mammalian transcriptomic database to explore gene expression regulation. Brief Bioinform, 2017,18(1):28-36.
[11] Xia L, Zou D, Sang J, Xu X, Yin H, Li M, Wu S, Hu S, Hao L , Zhang Z.Rice Expression Database (RED): an integrated RNA-Seq-derived gene expression database for rice. J Genet Genomics, 2017,44(5):235-241.
[12] Sang J, Wang Z, Li M, Cao J, Niu G, Xia L, Zou D, Wang F, Xu X, Han X, Fan J, Yang Y, Zuo W, Zhang Y, Zhao W, Bao Y, Xiao J, Hu S, Hao L, Zhang Z . ICG: a wiki-driven knowledgebase of internal control genes for RT-qPCR normalization. Nucleic Acids Res, 2017,46(Database Issue):D121-D126.
[13] Zou D, Sun S, Li R, Liu J, Zhang J, Zhang Z . MethB
文章导航

/