对于转录组数据而言,差异分析和富集分析是最核心的分析内容之一,通过TCGAbiolinks可以轻松实现TCGA表达谱数据的下载,差异分析,富集分析等功能,以乳腺癌的基因表达谱为例,分析过程如下
由于TCGA中乳腺癌的样本很多,所以只挑选了部分样本来测试,下载的过程如下
详细步骤如下
代码如下
代码如下
可视化的结果如下所示
GO的3大类别加上kegg pathway共4个类别的数据,对应4张柱状图,每个柱状图展示的是FDR值最显著的top10个条目,横坐标我-log10(FDR), 散点代表的是GeneRatio, 也称之为enrich factor, 代表富集到该通路下的差异基因个数占该通路下所有基因总数的比例。