【发布时间】:2019-10-08 11:27:12
【问题描述】:
我有一个带有 3 个 kafka 机器集群的真实环境,它正在接收大量数据。每个主题有 25 个分区,复制因子设置为 2。
我的应用程序(基于 kafka 流的应用程序)从这个 kafka 集群获取数据已停机一个多月。现在,每个分区都有大量的滞后;达到 90000000。
我知道以下参数:
max.poll.records ; default —> 500
max.partition.fetch.bytes ; default —> 1048576
fetch.max.bytes ; default —> 52428800
fetch.min.bytes ; default —> 1
max.poll.interval.ms ; default —> 300000
request.timeout.ms; default —> 30000
session.timeout.ms ; default —> 10000
我有 2 个消费者节点(使用来自 kafka 集群的数据的相同组 ID)。
但是,它并没有赶上滞后,它保持不变。谁能建议如何改进以降低延迟?
【问题讨论】:
标签: apache-kafka apache-kafka-streams