【发布时间】:2016-06-21 19:48:35
【问题描述】:
如果输出太大以至于无法放入减速器 RAM 中怎么办? 例如排序任务。在这种情况下,输出与输入一样大。如果您使用单个 reducer,则所有数据都无法放入 RAM。那么排序是如何进行的呢?
【问题讨论】:
-
您认为为什么会在 RAM 中发生这种情况?它完全在磁盘上完成。
-
它是否像外部合并排序一样完成?在聚合的情况下会发生什么?它会为每个 reduce() 调用写入磁盘吗?
标签: hadoop mapreduce reduce bigdata