【发布时间】:2020-03-25 03:58:51
【问题描述】:
我们有一个使用 kafka 作为输出的 spark 批处理应用程序。使用 spark 时有没有办法监控 Kafka 消费者组滞后?我们检查了 spark 文档,我们发现 spark 总是创建一个随机的 groupId 并使用一个检查点目录来控制偏移量。有没有你们推荐的方法或应用程序来衡量这个过程的滞后?我们找不到办法。
【问题讨论】:
-
你在哪里存储你的偏移量?如果该位置是可查询的,那么您可以计算与该位置和最新偏移量的差异
标签: apache-spark apache-kafka kafka-consumer-api