【发布时间】:2021-02-16 04:27:52
【问题描述】:
如何在任务中正确控制 Flink 的作业进行分布式/负载平衡(均匀或其他方式,我们可以设置Free-Slots/Physical MEM/CPU Cores/JVM Heap Size 等的阈值限制) - 集群中的经理?
例如,我在一个集群中有 3 个任务管理器,其中一个任务管理器负载很重,尽管有很多 Free Slots 并且其他资源在集群中的其他任务管理器中可用。
因此,如果某个特定的任务管理器负载过重,那么它可能会导致许多问题,例如Memory issues、heap issues、high back-pressure、Kafka lagging(可能会减慢source和sink操作)等可能导致容器多次重启。
注意:由于这个限制,我可能没有在这里提到所有可能的问题,但总的来说,distributed systems 我们不应该有这样的限制。
【问题讨论】:
标签: apache-flink flink-streaming distributed-system