前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >1000 Genome Project

1000 Genome Project

作者头像
生信修炼手册
发布2020-05-11 10:37:15
1.3K0
发布2020-05-11 10:37:15
举报
文章被收录于专栏:生信修炼手册生信修炼手册

1000 Genome Project 的目标是发现在人群中频率大于1%的变异位点,对来自不同人群的大量样本进行测序,识别到了许多的变异位点,为人类遗传变异的研究提供了一个综合的资源。

整个项目划分为四个阶段,试点阶段和三个主要阶段,主要阶段中只有第一阶段和第三阶段产生了数据,每个阶段数据的详细情况如下图所示

整个项目从2008年开始到2013年结束,最终的版本为2013年5月2日发布的数据, 包含了来自26个人群,共2504个样本的SNP分型结果。1000G的数据是免费公开的,可以通过ftp下载得到,网址如下

ftp://ftp.1000genomes.ebi.ac.uk/vol1/ftp/release/

26个不同的群体,用3个字母的缩写表示,具体情况如下

Code

Des

Detail

CHB

Han Chinese

Han Chinese in Beijing, China

JPT

Japanese

Japanese in Tokyo, Japan

CHS

Southern Han Chinese

Han Chinese South

CDX

Dai Chinese

Chinese Dai in Xishuangbanna, China

KHV

Kinh Vietnamese

Kinh in Ho Chi Minh City, Vietnam

CHD

Denver Chinese

Chinese in Denver, Colorado (pilot 3 only)

CEU

CEPH

Utah residents (CEPH) with Northern and Western European ancestry

TSI

Tuscan

Toscani in Italia

GBR

British

British in England and Scotland

FIN

Finnish

Finnish in Finland

IBS

Spanish

Iberian populations in Spain

YRI

Yoruba

Yoruba in Ibadan, Nigeria

LWK

Luhya

Luhya in Webuye, Kenya

GWD

Gambian

Gambian in Western Division, The Gambia

MSL

Mende

Mende in Sierra Leone

ESN

Esan

Esan in Nigeria

ASW

African-American SW

African Ancestry in Southwest US

ACB

African-Caribbean

African Caribbean in Barbados

MXL

Mexican-American

Mexican Ancestry in Los Angeles, California

PUR

Puerto Rican

Puerto Rican in Puerto Rico

CLM

Colombian

Colombian in Medellin, Colombia

PEL

Peruvian

Peruvian in Lima, Peru

GIH

Gujarati

Gujarati Indian in Houston, TX

PJL

Punjabi

Punjabi in Lahore, Pakistan

BEB

Bengali

Bengali in Bangladesh

STU

Sri Lankan

Sri Lankan Tamil in the UK

ITU

Indian

Indian Telugu in the UK

对于这26个群体,归属于5个不同的super population

Population Code

Description

EAS

East Asian

SAS

South Asian

AFR

African

EUR

European

AMR

American

除了通过FTP直接下载以外,还可以通过以下两种方式下载:

1. Aspera

由于1000G的数据量比较大,通常通过Aspera 进行下载,命令如下

ascp -i bin/aspera/etc/asperaweb_id_dsa.openssh -Tr -Q -l 100M -P33001 -L- fasp-g1k@fasp.1000genomes.ebi.ac.uk:vol1/ftp/release/20100804/ALL.2of4intersection.20100804.genotypes.vcf.gz ./

2. Globus

Globus 是一个软件,通过这个软件可以方便的管理和分发数据,官网如下:

https://www.globus.org/

首先需要注册一个账号,然后要下载软件才可以使用,和百度网盘的使用体验类似。

通常情况下使用Aspera就可以了。 1000G和hapmap都是对不同人群大量样本测试,然后鉴定变异位点。和hapmap相比,1000G无论是样本数量,还是变异位点的数量,都更具优势,所以使用1000G的科研工作者更多。随着hapmap官网的关闭,1000G完全取代了hapmap。

1000G中发现的SNP位点信息都提交到了dbSNP数据库,SV结构变异位点信息都提交到了DGVA数据库。

本文参与 腾讯云自媒体分享计划,分享自微信公众号。
原始发表:2018-05-27,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 生信修炼手册 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 1. Aspera
  • 2. Globus
相关产品与服务
数据库
云数据库为企业提供了完善的关系型数据库、非关系型数据库、分析型数据库和数据库生态工具。您可以通过产品选择和组合搭建,轻松实现高可靠、高可用性、高性能等数据库需求。云数据库服务也可大幅减少您的运维工作量,更专注于业务发展,让企业一站式享受数据上云及分布式架构的技术红利!
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档