【发布时间】:2020-05-23 01:24:46
【问题描述】:
我正在使用 Kafka 连接将文件接收到 HDFS,Kafka 连接具有 TopicPartitionWriter,它可以按时翻转到所有分区,并且没有基于大小的翻转。
我想针对每个分区进行基于大小和时间的翻转,因为通过每个分区的数据不统一,文件大小也相似。
2 个问题: 1. 如果我尝试通过更改 Kafka connect 中的大量代码来做到这一点,那会失去原始设计吗? 2.我的用例有什么做的吗?
【问题讨论】:
标签: apache-kafka hdfs apache-kafka-connect confluent-platform