【发布时间】:2016-05-02 16:09:46
【问题描述】:
我正在寻找与年龄相关的差异基因表达。我想使用线性混合模型来执行此操作,并将年龄指定为连续协变量。基因的表达来自不同的组织。组织作为固定效应,个体作为随机效应。
导入的数据集包含年龄作为字符串,值作为范围。例如:20-29 岁。我尝试使用上限和下限的平均值作为 num 类中的年龄值。当我在进行 ANOVA 后提取 Age 的 p 值时,它与我希望它来自先前报告的研究不同。我不确定是否可以使用 num 类,或者是否有任何其他方法可以在 R 中指定连续协变量。
谢谢
【问题讨论】:
-
如果年龄被编码为一个类别,我不明白如何将其视为一个连续变量 - 这样做可能会显着改变结果。
-
可能其他值不正确。您不应该“希望”对实验进行分析以成为一种特定的方式。如果新数据不能证实早期结果,挑战现有知识是有用的。 (但看来您确实需要统计咨询。)
-
使用类别的平均值(即假设类别内的分布均匀),或者像下面@r.kaiza 建议的那样做一些更花哨的事情,可能是您可以做的赌注。
标签: r mixed-models nlme