【发布时间】:2014-03-05 13:50:54
【问题描述】:
我有一个数据文件,我的任务是使用 map reduce 从文件的每一行创建一个新数据,因为文件中的数据很大。 例如:文件包含:表达式(3 -4 *7-4),我需要从这个表达式(3+4/7*4)中随机创建一个新表达式。当我使用 map reduce 实现任务时,我使用 map 进行更改,并且 reduce 只是为了从 mapper 接收数据并对它们进行排序 只使用 map 来完成主要任务是否正确?
【问题讨论】:
-
如果你想
sort他们,你必须使用reducer。映射阶段仅转换您的数据。但是从你的描述来看,貌似不需要对结果进行排序?
标签: hadoop