【问题标题】:Example of Yarn Queues in Dataproc (Spark v2)Dataproc (Spark v2) 中的纱线队列示例
【发布时间】:2018-05-23 04:27:02
【问题描述】:

有没有人能够在 Dataproc 中的 Spark 2.x 上向 yarn 添加超过默认队列的内容?

在集群创建时失败的尝试:

capacity-scheduler:yarn.scheduler.capacity.root.queues=alpha,beta,default yarn:yarn.scheduler.capacity.root.queues=alpha,beta,default

此外,在上述任一配置前缀上设置 yarn.scheduler.fair.allow-undeclared-pools=true 以激活动态队列也会失败。

所有情况似乎都使守护进程失败,导致资源管理器在启动时死机。

【问题讨论】:

    标签: apache-spark hadoop-yarn google-cloud-dataproc


    【解决方案1】:

    每个队列都需要指定容量。您的示例所需的属性如下:

    capacity-scheduler:yarn.scheduler.capacity.root.queues=alpha,beta,default
    capacity-scheduler:yarn.scheduler.capacity.root.alpha.capacity=20
    capacity-scheduler:yarn.scheduler.capacity.root.beta.capacity=20
    capacity-scheduler:yarn.scheduler.capacity.root.default.capacity=60
    

    所有指定的容量总和为根队列资源的 100%。容量调度程序的全套配置选项可以在 Hadoop documentation 中找到。

    【讨论】:

    • all capacities specified sum to 100% of the root queues resources 是我搞砸的部分。谢谢!
    猜你喜欢
    • 1970-01-01
    • 2020-05-27
    • 2021-09-16
    • 2018-10-28
    • 2016-02-06
    • 2019-03-09
    • 2013-02-16
    • 2016-05-11
    • 1970-01-01
    相关资源
    最近更新 更多