【发布时间】:2023-01-06 23:07:44
【问题描述】:
假设我有一个带有键 A 和属性 B、C 和 D 的事件。在我的传入流中,该事件如下所示: 答:{B="BVal", C="CVal", D="DVal"} 现在我只需要 A、B 和 C 的信息,这就是我使用 ksql 选择 B 和 C 的原因。现在我的流看起来像这样: 答:{B="BVal", C="CVal"} 现在为传入流生成以下事件: 1:{B="猫", C="狗", D="鱼"} 因为我只是选择 B 和 C,所以我的活动应该如下所示: 1:{B="猫", C="狗"} 我遇到的问题是,如果我遇到这样的事件: 1:{B="Cat", C="Dog", D="Rabbit"} 创建以下事件: 1:{B="猫", C="狗"} 这是完全相同的事件。因此我的问题是:我如何确保我不会两次产生完全相同的事件? (只是因为它不是必需的,而且我不希望我的流消费应用程序重新消费完全相同的事件)
我可以想象某种比较——也许每个键都有一个哈希值。 也许还有其他最佳实践
【问题讨论】:
标签: apache-kafka ksqldb