【发布时间】:2017-04-24 10:30:51
【问题描述】:
我有一个线性混合效应模型没有在 R 中完成的问题。
我使用包lmekin 来运行模型,因为我将亲属关系矩阵拟合为随机效应。我使用的公式是:
模型
phenotype_df 是一个数据框,包含 12000 个人,每个人都有疾病状态(1 或 0)、分数和年龄。 (注:我在这里将疾病状态视为定量)。
kinship_mx 是亲属关系矩阵,即。一个对角线约为 0.5 的正定矩阵 (12000x12000)。
当我使用约 1000 个人时,此模型运行大约 1 分钟。但是,我让模型在我们的大型服务器上运行所有 12000 个人,但 5 天后还没有完成。任何人都可以提出为什么会发生这种情况的原因以及是否有任何解决方案可以使模型完成?
【问题讨论】:
-
根据我的经验,这根本没有意义。 12000 的大小并不荒谬,您要求它做的事情相对简单。如果您可以检查系统分析器/任务管理器以查看它是否实际上仍在运行。然后我会尝试在你的本地机器上运行脚本,每次添加 1000,看看你是否可以在某个可以调试的时候收到错误消息。
-
只是为了回复更多信息-我检查了
top,它肯定还在运行。我一直在尝试“添加 1000”——运行 2000 个人需要 50 分钟。仍在使用其他增量运行。 -
如果是这种情况,您可能想尝试使用 r 中的多核库之一来分散工作。
标签: r statistics