【发布时间】:2020-04-22 14:54:44
【问题描述】:
对于每个 spark.streaming.blockInterval(比如 1 分钟),接收器都会监听流式数据源的数据。假设当前的微批处理花费了非常长的时间来完成(故意的,比如说 20 分钟)。在这个微批处理期间,Receivers 是否仍会监听流式传输源并将其存储在 Spark 内存中?
当前管道使用 Spark 结构化流在 Azure Databricks 中运行。 谁能帮我理解这一点!
【问题讨论】:
标签: apache-spark spark-streaming spark-structured-streaming