【发布时间】:2018-01-26 11:31:18
【问题描述】:
我目前正在使用以下代码通过 linux 集群运行堆叠物种分布模型:
library(SSDM)
setwd("/home/nikhail1")
Env <- load_var(path = getwd(), files = NULL, format = c(".grd", ".tif",
".asc",
".sdat", ".rst", ".nc",
".envi", ".bil", ".img"), categorical = "af_anthrome.asc",
Norm = TRUE, tmp = TRUE, verbose = TRUE, GUI = FALSE)
Occurrences <- load_occ(path = getwd(), Env, file =
"Final_African_Bird_occurrence_rarefied_points.csv",
Xcol = "decimallon", Ycol = "decimallat", Spcol =
"species", GeoRes = FALSE,
sep = ",", verbose = TRUE, GUI = FALSE)
head(Occurrences)
warnings()
SSDM <- stack_modelling(c("GLM", "GAM", "MARS", "GBM", "RF", "CTA",
"MAXENT", "ANN", "SVM"), Occurrences, Env, Xcol = "decimallon",
Ycol = "decimallat", Pcol = NULL, Spcol = "species", rep = 1,
name = "Stack", save = TRUE, path = getwd(), PA = NULL,
cv = "holdout", cv.param = c(0.75, 1), thresh = 1001,
axes.metric = "Pearson", uncertainty = TRUE, tmp = TRUE,
ensemble.metric = c("AUC", "Kappa", "sensitivity",
"specificity"), ensemble.thresh = c(0.75, 0.75, 0.75, 0.75), weight = TRUE,
method = "bSSDM", metric = "SES", range = NULL,
endemism = NULL, verbose = TRUE, GUI = FALSE, cores = 200)
save.stack(SSDM, name = "Bird", path = getwd(),
verbose = TRUE, GUI = FALSE)
我在尝试运行分析时收到以下错误消息:
Error in socketConnection("localhost", port = port, server = TRUE, blocking
= TRUE, :
all connections are in use
Calls: stack_modelling ... makePSOCKcluster -> newPSOCKnode ->
socketConnection
如何增加最大连接数?我可以在 SSDM 包中执行此操作,因为 parallel 是内置的。我是否必须应用另一个包中的特定功能才能确保我的工作在集群中顺利运行?
感谢您的帮助, 尼哈伊尔
【问题讨论】:
-
欢迎来到 SO!您能否也将
sessionInfo()的输出添加到问题中(底部的另一个代码块很好)。这将有助于缩小系统类型,这可能是必要的,因为这可能是对操作系统级别设置的调整。 -
我已经尝试仅使用 19 个内核运行代码。这不会产生错误,但会增加计算时间
-
会话信息的输出:R 版本 3.4.3 (2017-11-30) 平台:x86_64-pc-linux-gnu (64-bit) 运行条件:CentOS 版本 6.9 (Final) 矩阵产品:默认 BLAS:/apps/R/R-3.4.3-gcc/lib64/R/lib/libRblas.so LAPACK:/apps/R/R-3.4.3-gcc/lib64/R/lib/libRlapack。所以语言环境:[1] C 附加基础包:[1] 统计图形 grDevices utils 数据集方法基础通过命名空间加载(未附加):[1] compiler_3.4.3
标签: r parallel-processing cluster-computing bioinformatics