文章/答案/技术大牛

发布

社区首页 >问答首页 >如何从FASTQ文件中提取序列行？

问如何从FASTQ文件中提取序列行？
EN

Unix & Linux用户

提问于 2017-10-13 05:40:32

回答 1查看 6.3K关注 0票数 0

FASTQ格式的Illumina序列文件如下：

@ERR009148.2485 IL26_1382:7:1:224:616 length=36
ATCACATGCTCCTTGTTCTGCAGCTTGGTGCGGATG
+ERR009148.2485 IL26_1382:7:1:224:616 length=36
>>>>>>>>>>>>>>>>>>><>><>>>5>>->><->*
@ERR009148.2486 IL26_1382:7:1:914:59 length=36
AAAGAAGTAAAATAAGAAGGCAATGCTTGTGGAAGG
+ERR009148.2486 IL26_1382:7:1:914:59 length=36
.>>74::1>174151/7152313,3&003,00&2%2
@ERR009148.2487 IL26_1382:7:1:251:589 length=36
GCCATAAACACCCCAGCACCACATTCATCAGAAGGG
+ERR009148.2487 IL26_1382:7:1:251:589 length=36
>>>>>>>>>>>>>>>>>>>>>>8>>>>>>><;<>>7
@ERR009148.2488 IL26_1382:7:1:911:194 length=36
ATTGAGGTGGAGTAGATTAGGCGTAGGTAGAAGTAG
+ERR009148.2488 IL26_1382:7:1:911:194 length=36
<>>>=>>>>>>>=;<:>>7>==<<7;=67=/57/57

我只需要从每个记录中提取原始序列。对此可以使用什么sed命令？

预期产出：

ATCACATGCTCCTTGTTCTGCAGCTTGGTGCGGATG
AAAGAAGTAAAATAAGAAGGCAATGCTTGTGGAAGG
GCCATAAACACCCCAGCACCACATTCATCAGAAGGG
ATTGAGGTGGAGTAGATTAGGCGTAGGTAGAAGTAG

text-processing

sed

bioinformatics

回答 1

Unix & Linux用户

发布于 2017-10-13 05:45:30

使用sed。

sed -n '/^[ATGC]/p' infile

使用grep：

grep '^[ATGC]' infile

使用awk：

awk '/^[ATGC]/' infile

所有这些都将返回以一个A, C, T, G字母开头的行。

票数 2

页面原文内容由Unix & Linux提供。腾讯云小微IT领域专用引擎提供翻译支持

原文链接：

https://unix.stackexchange.com/questions/397861

复制

相似问题

问如何从FASTQ文件中提取序列行？
EN

回答 1

Unix & Linux用户

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

问如何从FASTQ文件中提取序列行？EN

回答 1

Unix & Linux用户

社区

活动

圈层

关于

腾讯云开发者

热门产品

热门推荐

更多推荐

问如何从FASTQ文件中提取序列行？
EN