【发布时间】:2019-08-16 17:31:12
【问题描述】:
我想使用 Spark Structured Streaming 从安全的 kafka 中读取数据。这意味着我需要强制使用特定的 group.id。但是,正如文档中所述,这是不可能的。 尽管如此,在databricks 文档https://docs.azuredatabricks.net/spark/latest/structured-streaming/kafka.html#using-ssl 中,它说这是可能的。这只是指天蓝色集群吗?
此外,通过查看 apache/spark repo https://github.com/apache/spark/blob/master/docs/structured-streaming-kafka-integration.md 的 master 分支的文档,我们可以了解到此类功能旨在在以后的 spark 版本中添加。你知道这样一个稳定版本的任何计划,这将允许设置消费者 group.id 吗?
如果没有,Spark 2.4.0 是否有任何变通方法可以设置特定的使用者 group.id?
【问题讨论】:
标签: apache-spark apache-kafka spark-structured-streaming spark-kafka-integration