【发布时间】:2018-10-04 15:30:14
【问题描述】:
我正在松散地基于 this confluent code 为 Kafka Streams 应用程序创建一个 30 分钟的重复数据删除存储(以解决与 Kafka 的一次性处理保证不同的问题),并希望最大限度地减少拓扑启动时间。
此代码使用持久窗口存储,这要求我指定要使用的日志段的数量。假设我想使用 2 个段,并且使用 1GB 的默认段大小,这是否意味着在重新平衡期间,客户端必须在应用程序启动之前读取 2GB 的数据?
【问题讨论】:
标签: apache-kafka apache-kafka-streams confluent-platform