【发布时间】:2021-04-28 08:25:43
【问题描述】:
来自 Databricks 文档:
高并发集群
高并发集群是托管的 云资源。高并发集群的主要好处是 他们提供 Apache Spark 原生的细粒度共享,以最大限度地 资源利用率和最小查询延迟。
高并发集群仅适用于 SQL、Python 和 R。 高并发集群的性能和安全性由 在单独的进程中运行用户代码,这是不可能的 斯卡拉。
-
为什么 Scala 不可能做到这一点?这个问题的主要方面。
-
Apache Spark 原生细粒度共享,可实现最大资源利用率和最小查询延迟。我对 Spark 的工作原理有一个很好的了解,但如果有一些额外的考虑,可能会在这里澄清一下。
-
顺便说一句,大多数人都在每人运行自己的标准集群或使用 HAC 使用 SQL 等。我认为 HAC 将是要走的路 - 一般而言。
【问题讨论】:
标签: scala apache-spark databricks