【问题标题】:How to keep flink batch job running continuously on local如何保持 flink 批处理作业在本地连续运行
【发布时间】:2021-07-24 13:33:34
【问题描述】:

我正在 Windows 10 机器上通过 flink 批处理机制练习文件读取。

我从 flink 官网下载了 flink-1.7.2-bin-hadoop24-scala_2.12.tgz 并执行了 start-cluster.bat 。

我通过 Flink 的 UI 上传了 jar,并且能够执行作业,但作业在几秒钟内完成。

我想保持作业持续运行,以便我可以测试我的用例。

您能指导我实现这一目标的可能方法吗?

【问题讨论】:

  • 保持批处理作业连续运行是什么意思?
  • @DavidAnderson:作业应该一直运行,除非我手动停止。
  • 为什么不用 DataStream API 来运行它呢?

标签: java apache-flink flink-streaming flink-batch


【解决方案1】:

在 Flink 中,批处理作业会一直运行,直到处理完所有输入,此时它们已完成并终止。如果你想要连续处理,那么你应该要么

  • 使用一些部署自动化(在 Flink 之外)来安排根据需要创建新的批处理作业,或者
  • 实现流式作业

在您的情况下,听起来您可能正在寻找StreamExecutionEnvironment.readfile 上的FileProcessingMode.PROCESS_CONTINUOUSLY 选项——请参阅docs 了解更多信息。

【讨论】:

  • 你有示例程序可以参考吗?
  • 第 2 点“实现流式作业”:可以完成什么样的实现。您能详细说明一下吗?
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2014-06-20
相关资源
最近更新 更多