【发布时间】:2015-11-03 20:39:44
【问题描述】:
编程模型 MapReduce 由 2 个过程组成,map 和 reduce。当我们可以简单地在 reduce 函数中进行映射时,为什么我们需要 map 部分。
考虑以下伪代码:
result = my_list.map(my_mapper).reduce(my_reducer);
这可以缩短为
result = my_list.reduce(lambda x : my_reducer(my_mapper(x)));
第一种方法如何比第二种方法更受青睐,而第一种方法需要再通过一次数据?我的代码示例是否过于简单?
【问题讨论】:
标签: hadoop mapreduce apache-spark functional-programming