【发布时间】:2020-12-10 18:14:12
【问题描述】:
我有一个工作,它使用 Kafka 连接器阶段来读取 Kafka 队列,然后加载到数据库中。该作业以连续模式运行,它没有时间结束,因为它一直在实时监控 Kafka 队列。
由于意外原因(例如,服务器问题、作业问题等),作业可能会因失败而终止。通常,这发生在该作业运行 300 小时之后。因此,为了让作业保持活力,我必须手动查看作业状态,然后执行重置并运行,以保持作业运行。
问题在于,在作业终止和我的手动重置和运行之间可能会经过几个小时,这很关键。因此,我正在寻找一种方法来消除手动交互并通过自动化作业调用来减少这种差距。
我尝试使用 Control-M 每天运行该作业,但没有成功:Control-M 调用该作业的第一天,它运行良好。但是在第二天,当 Control-M 再次尝试实例化作业时它失败了(因为它已经在运行)。此外,Datastage 永远不会告诉 Control-M 作业已成功结束,因为作业的性质不允许这样做。
这么说,我想听听你的想法,可以照亮我。
首先想到的是创建一个中间序列,然后在 Control-M 中安排它。然后,这个新的序列将通过使用命令行阶段异步调用连续作业。
【问题讨论】:
标签: apache-kafka etl real-time datastage control-m