【发布时间】:2015-09-17 08:11:24
【问题描述】:
您好,我想知道是否有解决方案可以使用 spark-submit 发送 R 包并在 SparkR 的计算节点上使用它们?
【问题讨论】:
-
您必须使用配置管理系统来安装它们,该系统允许您定义 IT 基础架构的状态,然后自动强制执行正确的状态,例如 puppet 或 chef。
-
确实有可能,因为 zip 打包的 R 包可以通过
install.packages("<package name>, repos=NULL)安装,并且 zip 文件被发送到 YARN 缓存(即工作目录或 SparkR)。我找不到一个非常简单的方法,所以希望有人能回答;)
标签: r apache-spark hadoop2 sparkr