【发布时间】:2017-12-01 09:29:04
【问题描述】:
我正在尝试基于具有数值和分类特征的大数据框计算相异矩阵。当我从 cluster package 运行 daisy 函数时,我收到错误消息:
错误:无法分配大小为 X 的向量。
在我的例子中,X 大约是 800 GB。知道如何处理这个问题吗?此外,如果有人可以帮助我在并行内核中运行该功能,那也很棒。您可以在下面找到计算 iris 数据集上的相异矩阵的函数:
require(cluster)
d <- daisy(iris)
【问题讨论】:
-
你介意添加更多细节,为什么这不是欺骗?一眼看去,它确实像一个重复的帖子,但有额外的信息。
-
如果您没有足够的内存,我无法理解您期望并行化如何提供帮助。你估计得到的矩阵有多大吗?
-
我已经结束了你之前的问题。
-
不,它们是相互关联的问题。不要将它们分开。您通常可以以牺牲速度为代价来解决内存问题。
-
你需要一种比蛮力更聪明的方法。
标签: r cluster-computing r-daisy