【发布时间】:2019-01-28 17:38:43
【问题描述】:
按照 Direct 方法,它们是 32 个 Kafka 分区和 32 个消费者。 但是 32 个消费者的数据处理速度比 Kafka 速率(1.5x)慢,这会导致 Kafka 中的数据积压。
我想增加每个消费者收到的 Dstream 的分区数。
我希望解决方案是增加消费者的分区,而不是增加 Kafka 的分区。
【问题讨论】:
标签: apache-spark apache-kafka spark-streaming rdd dstream