前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >7 比对到参考基因组输出bam文件

7 比对到参考基因组输出bam文件

作者头像
Y大宽
发布2019-06-15 14:55:49
1.6K0
发布2019-06-15 14:55:49
举报
文章被收录于专栏:Y大宽


接下来用 BWA mem把fastq map到参考基因组 hg38 版本。 比对结果直接通过管道传给samtools处理,节省 I/O 时间。 因为空间问题,比对好的文件放在 /project/align/wes目录

6.1设置好下面批量比对的数据文件

kelly/wesproject/4_clean/wes目录下,也可以在align/wes目录下写完整路径

代码语言:javascript
复制
ls *1.fq.gz> 1
ls *2.fq.gz> 2
paste 1 2 > config
#vim config 写入第一列样本名,要以Tab分开
cat 1|cut -d"_" -f 2,3 1>0
paste 0 1 2 > config

6.2 比对

align/wes目录下 根据前面的经验,先尝试一次并行比对50个文件

代码语言:javascript
复制
(wes) pc@lab-pc:/home/kelly/wesproject/4_clean/wes$ cat config|head -50 > config_50
代码语言:javascript
复制
INDEX=/data/bigbiosoft/GATK/resources/bundle/hg38/bwa_index/gatk_hg38
cat /home/kelly/wesproject/4_clean/wes/config_50|while read id
do 
arr=($id)
sample=${arr[0]}
fq1=${arr[1]}
fq2=${arr[2]}
echo $sample $fq1 $fq2
bwa mem -t 20 -R "@RG\tID:$sample/tSM:$sample\tLB:WGS\tPL:Illumina" $INDEX /home/kelly/wesproject/4_clean/wes/$fq1 /home/kelly/wesproject/4_clean/wes/$fq2 |samtools sort -@ 20 -o $sample.bam -  &
done

注意bam命令的-R参数,不加也可以运行,但是后面的gatk时会报错,但是也有解决办法,见后面。-t 和-@是线程数

本文参与 腾讯云自媒体同步曝光计划,分享自作者个人站点/博客。
原始发表:2019.06.11 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 6.1设置好下面批量比对的数据文件
  • 6.2 比对
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档