【发布时间】:2022-11-10 23:38:21
【问题描述】:
我在我的公司使用 Flink,我正在考虑应用几个场景来查看每个案例的性能。
以下是我将处理的场景
- 实验
- 端到端
- Exactly-At-Once 或 At-least-once
- 来源:卡夫卡
- 接收器:Mysql 和 Redis
- 逻辑:简单的计数逻辑
对于 Exactly-At-Once,我将使用 TwoPhaseCommitSink 来实现该案例。 在做实验之前,我想知道以下一些问题。
- sink 的性能速度
如您所见,我将使用 mysql (RDB) 作为接收器。当我们将 RDB 用于 at-least-once 或exactly-at-once 时,是否有任何描述性的基准测试结果?我认为当sink使用数据库时,吞吐量会受到影响,因为连接和与数据库通信需要一些时间。但是在使用 Sink for RDB 时,我找不到任何文档或技术博客显示 Flink 基准测试的详细结果。 特别是,我还想知道
Exactly-at-once会比at-least-once性能下降更多,并且由于处理速度慢,很难用于商业目的。 所以我的问题如下。-
使用数据库接收器(mysql 或 redis)的两种语义模式(至少一次,恰好一次)是否有任何信息性结果?
-
使用 mysql sink 时,端到端的 Exactly-at-once 语义会很慢吗?我将应用 twophasecommitsink。
谢谢。
-
【问题讨论】:
标签: apache-flink