【发布时间】:2019-10-08 11:34:31
【问题描述】:
我在 EMR (emr-5.20.0) 上有一个集群,其中一个 m5.2xlarge 作为 Node Master,两个 m4.large 作为核心,三个 m4.large 作为 node worker。这个集群的内存总和是 62GB,但是在 YARN UI 中显示的总内存是 30GB。
有人可以帮我理解这个值是如何计算的吗?
我已经检查了 Yarn-site.xml 和 spark-default.conf 中的配置,它们是根据 AWS 推荐配置的:https://docs.aws.amazon.com/pt_br/emr/latest/ReleaseGuide/emr-hadoop-task-config.html#emr-hadoop-task-config-m5
欢迎任何帮助
【问题讨论】:
-
正如@michal-lemay 所说,您不包括主节点,只包括工作节点,因此您使用了错误的推荐设置。
标签: apache-spark hadoop pyspark hadoop-yarn apache-zeppelin