【发布时间】:2015-07-20 21:43:37
【问题描述】:
我第一次使用Oozie,发现解析规范有点困难。我正在尝试创建一个简单的工作流程,其中我在Hive 中运行一些查询,然后执行shell 操作以便使用不同的程序进行一些分析,最后我想执行@987654324 @工作通过Oozie。
虽然我了解如何单独执行所有这些操作,但如何设置我的工作流程以便最终的 Java 作业在开始之前等待文件生成?谷歌搜索,我看到了让 Oozie 工作流在开始之前等待数据集生成的方法,但我不希望整个工作流等待,因为我只希望工作流中的一个特定操作等待要生成的输入文件。
输入文件会很简单——很可能我只有第二个动作,shell 一个,在它退出之前执行一些命令,如touch $(date -u "+%Y-%m-%d-%H").done,这样我的输入文件将是一个零 - byte 文件,名称类似于 2015-07-20-14.done。
【问题讨论】:
标签: java hadoop mapreduce hive oozie