【发布时间】:2013-11-12 09:01:28
【问题描述】:
oozie 是 Hadoop 平台的工作流引擎,它是否提高了 MapReduce 作业的 DAG 依赖项的执行性能?
我的意思是,由于一个 MapReduce 作业的输出作为 DAG 中下一个 MapReduce 作业的输入,oozie 是否提供任何机制来将中间结果存储在内存中,从而节省 I/O。
或者它只是一个工作流管理器,协调一系列依赖的 MapReduce?
想知道 oozie 在内部是如何工作的吗?
【问题讨论】:
标签: hadoop mapreduce hdfs distributed-computing oozie