【发布时间】:2014-02-04 18:35:54
【问题描述】:
我正在一个由我们的多个应用程序共享的集群上运行 Hadoop 作业。我们有大约 40 个节点和 4 个映射器插槽/节点。每当我的作业(只是映射器)运行时,它会占用所有 160 个插槽并阻止其他作业运行。我尝试使用任务代码将作业“mapred.tasktracker.map.tasks.maximum=1”和“mapred.map.tasks”中的属性设置为 30(将其限制为仅 30 个节点)。
conf.setInt ( "mapred.tasktracker.map.tasks.maximum", 1 );
conf.setInt ( "mapred.map.tasks", 30 );
conf.setBoolean ( "mapred.map.tasks.speculative.execution", false );
我有两个问题:
一个。当作业运行时,job.xml 反映了“mapred.tasktracker.map.tasks.maximum=1”,但作业最终仍占用 160 个插槽。
b. job.xml 中的 mapred.map.tasks 不是 30。它仍然是一个很大的数字(比如 800)。
任何帮助将不胜感激。
【问题讨论】:
标签: java hadoop mapreduce hbase