【发布时间】:2018-04-08 21:13:56
【问题描述】:
我对 R 比较陌生,最近开始使用它来分析一些微阵列数据。分析的总体目标是采用 DC2 并比较该人群中的 WT 与 KO 组。但是我遇到了 limma 处理的一些问题。使用 oligo 包处理数据后,我尝试创建一个设计矩阵以使用 limma 进行分析。这是我对 DC2 的 ExpressionSet 的工作流程:
pData(DC2)
index filename genotype cell_type
1 KO DC2 2 HP10.CEL KO DC2
2 KO DC2 3 HP11.CEL KO DC2
3 KO DC2 4 HP12.CEL KO DC2
1 WT DC2 10 HP7.CEL WT DC2
2 WT DC2 11 HP8.CEL WT DC2
3 WT DC2 12 HP9.CEL WT DC2
design <- model.matrix(~DC2$genotype)
design
(Intercept) DC2$genotypeWT
1 1 0
2 1 0
3 1 0
4 1 1
5 1 1
6 1 1
fit <- lmFit(DC2, design)
fit <- eBayes(fit)
toptable(fit)
这会输出如下基因列表:
logFC t P.Value adj.P.Val B
17551163 14.09722 208.2627 2.990326e-13 2.700912e-10 17.14467
17511316 13.91167 205.0811 3.292503e-13 2.700912e-10 17.12716
17551167 13.92093 204.5801 3.343243e-13 2.700912e-10 17.12434
17375373 13.76320 202.1271 3.605170e-13 2.700912e-10 17.11025
17550685 13.74022 201.5428 3.671032e-13 2.700912e-10 17.10682
但是,当我使用此代码手动检查时(仅采用第一个功能):
toptable(fit, n=1)
genename <- rownames(toptable(fit, n=1))
typeMean <- tapply(exprs(DC2)[genename,], DC2$genotype, mean)
typeMean["KO"] - typeMean["WT"]
相同特征“17551163”的输出不同
KO
0.04538317
我试图四处寻找答案,但没有运气。我假设这可能与矩阵设计有关?任何帮助将不胜感激。
谢谢
【问题讨论】:
-
您能否发布“17551163”的表达式值?
-
@PoGibas 感谢您的回复。表达值为:“1 KO DC2”14.0912151923856“2 KO DC2”14.0912151923856“3 KO DC2”14.14.092351251855“1 WT DC2”14.0592734145348“2 WT DC2”14.03271978068“3 WT DC2”14.0635228171713 span>
-
尝试将
coef参数放入topTable,以声明您感兴趣的对比度:topTable(fit, coef = 2)。这会改变输出吗? -
@storaged 啊,太好了。这似乎奏效了——非常感谢。只是从概念上讲,
coef = 2位是否指定了DC2$genotypeWT列中 0 和 1 之间的比较?那么当我设置coef = 1时,会将(Intercept)中的1 与DC2$genotypeWT列中的0 和1 进行比较? -
@Jack 据我所知
limma包它就是你描述它的方式。coef = 2明确表示我们希望在DC2$genotypeWT内进行比较。很高兴它对你有用!
标签: r bioinformatics bioconductor limma