【发布时间】:2016-06-14 03:23:16
【问题描述】:
我编写了 R 程序,它生成一个长度为 100 万的随机向量。我需要模拟它一百万次。在 100 万个模拟中,我将使用 50K 个观察到的向量(以某种随机方式选择)作为样本。所以,50K 跨 1M 是样本大小。有没有办法在 R 中处理它?
问题很少,也有一些不太好的解决方案。
First R 无法在我的机器中存储如此庞大的矩阵。它超过了 RAM 内存。我查看了诸如 bigmemory、ffbase 等使用硬盘空间的软件包。但是如此庞大的数据可以有 TB 的大小。我的机器上有 200GB 硬盘可用。
即使可以存储,也存在运行时间的问题。代码可能需要超过 100 小时的运行时间!
任何人都可以提出一条出路!谢谢
【问题讨论】:
标签: r database memory memory-management