【发布时间】:2016-01-19 06:41:48
【问题描述】:
我有这个配置:
- Hadoop:v2.7.1(纱线)
- 输入文件:大小 = 100 GB。
- 3 个从站:每个从站有 4 个 VCORES,速度 = 2 GHz,RAM = 8 GB
- 5 个从站:每个从站有 2 个 VCORES,速度 = 1 GHz,RAM = 2 GB
- MapReduce 程序:WordCount
如何通过将较小的输入拆分分配给 5 个较慢的从属并将较大的输入拆分分配给 3 个最快的从属,从而最大限度地减少 WordCount 执行时间?
【问题讨论】:
标签: hadoop optimization mapreduce