原文链接:关于Count,FPKM,TPM,RPKM等表达量的计算及转换 | 干货
写在前面
今天使用count
值转化TPM
,或是使用FPKM
转换成TPM
。这样的教程,我们在前面已经出国一起相对比较详细的教程了,一文了解Count、FPKM、RPKM、TPM | 相互间的转化,在这个教程中,我们也归纳了各个数值的含义。但是,也许你看到后,会添加到自己的收藏夹中,但是,后面就没有看了。自己也是这样的,一个人的时间和精力是有限的,我们不可能有那么多的精力。因此,做学习笔记就有很大的帮助,当自己使用的时候有地方找寻。
本教程涉及的数据、代码和文件等在社群中可获得!!
回顾一下知识点
Count
**定义:**高通量测序中比对到exon上的reads数。可以使用featureCounts、HTseq-count等软件进行计算。
**优点:**可以有效说明该区域是否真的有表达及真实的表达丰度。能够近似呈现真实的表达情况。
**缺点:**由于exon长度不同,难以进行不同exon丰度比较;由于测序总数不同,难以对不同测序样本间比较。
FPKM
FPKM: FPKM的全称为Fragments Per Kilobase Million,Fragments Per Kilobase of exon model per Million mapped fragments(每千个碱基的转录每百万映射读取的fragments)。通俗讲,把比对到的某个基因的Fragment数目,除以基因的长度,其比值再除以所有基因的总长度。注意,这里的基因长度是指基因外显子的总长度。
RPKM
RPKM: Reads Per Kilobase of exon model per Million mapped reads (每千个碱基的转录每百万映射读取的reads);
FPKM与RPKM的区别
RPKM通常用于单端测序,FPKM常用于双端测序