【发布时间】:2013-08-16 07:45:04
【问题描述】:
我对 M/R 程序非常陌生。我在 HDFS 中有一个文件,其中包含此结构中的数据
EmpId,EmpName,Dept,Salary,
1231,userName1,Dept1,5000
1232,userName2,Dept2,6000
1233,userName3,Dept3,7000
.
.
.........................
现在我想找到薪水最高的员工的姓名
我已经写了一个 map reduce 来找到最高薪水。在我的 mapper 类中,我发出了这样的输出
output.collect("最大值",员工工资);
在减速器中,我找到了键“最大值”的最大值。现在我想在映射器中使用这个值并找到获得最高薪水的员工的姓名。我如何发送减速器输出到映射器作为输入?这是完成我的任务的好方法吗?还有其他建议吗?
【问题讨论】:
标签: hadoop mapreduce hadoop-partitioning