【发布时间】:2016-06-24 00:00:05
【问题描述】:
我有一个使用 job.waitForCompletion(true) 运行的 MapReduce 作业。如果一个/多个 reducer 任务在作业执行过程中被杀死或崩溃,则整个 MapReduce 作业将重新启动,并再次执行 mapper 和 reducer(文档)。以下是我的问题:
1] 我们能否在作业开始时知道作业是重新开始还是由于上一次运行中的某些故障而重新启动? (这导致我进入第二季度)
2] 计数器可以提供帮助吗?如果某些任务失败,计数器的值是否会被结转,从而导致整个作业重新启动?
3] Hadoop 是否提供任何内置检查点方法来跟踪先前的计算并帮助避免在失败/崩溃之前执行映射器和化简器完成的相同计算?
对不起,如果问题的措辞不清楚。 感谢您的帮助。
【问题讨论】:
标签: java hadoop mapreduce crash-recovery