【发布时间】:2019-08-18 16:14:36
【问题描述】:
我试图找到一种快速的方法来计算值向量和矩阵之间的相关性。转置数据后,我有一个包含 200 行和 400,000 个观察值的数据框。我需要找到每列和其他列之间的 cor。
我的代码在下面,但是太慢了。谁能想出一个更快的方法。
for(i in 1:400000){
x=cor(trainDataNew[,i],trainDataNew[,-i])
}
您不需要我的数据来执行此操作。您可以创建如下所示的随机数据。
norm1 <- rnorm(1000)
norm2 <- rnorm(1000)
norm3 <- rnorm(1000)
as.data.frame(cbind(norm1,norm2,norm3))
【问题讨论】:
标签: r parallel-processing correlation