【发布时间】:2014-08-10 12:53:48
【问题描述】:
我使用 Spark 构建了一个机器学习管道,该管道将作业 XML 文件作为输入,用户可以在其中指定数据、特征、模型及其参数。使用这个作业 XML 输入文件的原因是用户可以简单地修改他们的 XML 文件来配置管道,而不需要从源代码重新编译。但是,目前 Spark 作业通常被打包成一个 uber-Jar 文件,并且在将作业提交给 YARN 时似乎没有办法提供额外的 XML 输入。
我想知道是否有任何解决方案或替代方案?
【问题讨论】: