【问题标题】:Hadoop MapReduce2 Optimization in Heterogeneous Cluster异构集群中的 Hadoop MapReduce2 优化
【发布时间】:2016-01-19 06:41:48
【问题描述】:

我有这个配置:

  • Hadoop:v2.7.1(纱线)
  • 输入文件:大小 = 100 GB。
  • 3 个从站:每个从站有 4 个 VCORES,速度 = 2 GHz,RAM = 8 GB
  • 5 个从站:每个从站有 2 个 VCORES,速度 = 1 GHz,RAM = 2 GB
  • MapReduce 程序:WordCount

如何通过将较小的输入拆分分配给 5 个较慢的从属并将较大的输入拆分分配给 3 个最快的从属,从而最大限度地减少 WordCount 执行时间?

【问题讨论】:

    标签: hadoop optimization mapreduce


    【解决方案1】:

    对于每台机器,您可以确定 map/reduce 插槽的数量,因此如果您想向速度较慢的机器发送更少的工作负载,您可以定义,例如每台较慢的机器有 2 个 map/reduce 任务插槽和 4 个 map/reduce 任务每个快速机器的插槽。通过这种方式,您可以控制集群中每个不同节点接收的工作负载量。

    【讨论】:

    • 不知道为什么YARN在容器配置中不支持VCORE SPEED!
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2017-12-02
    • 1970-01-01
    • 2018-11-11
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多