【发布时间】:2021-11-29 07:34:13
【问题描述】:
我一直在关注这个tutorial,它让我可以从 Python 连接到 Databricks,然后运行增量表查询。但是,我偶然发现了一个问题。当我第一次运行它时,我收到以下错误:
帐户中的容器容器名称 找不到 storage-account.blob.core.windows.net,我们无法创建 它使用匿名凭据,并且在 配置。
当我回到我的 Databricks 集群并运行这段代码 sn-p
from pyspark import SparkContext
spark_context =SparkContext.getOrCreate()
if StorageAccountName is not None and StorageAccountAccessKey is not None:
print('Configuring the spark context...')
spark_context._jsc.hadoopConfiguration().set(
f"fs.azure.account.key.{StorageAccountName}.blob.core.windows.net",
StorageAccountAccessKey)
(其中StorageAccountName 和AccessKey 是已知的)然后再次运行我的Python 应用程序,它成功运行而不会抛出之前的错误。我想问一下,有没有办法从我的 Python 应用程序运行这段代码 sn-p 并同时反映在我的 Databricks 集群上?
【问题讨论】:
-
您是通过 Databrics Connect 运行此代码,还是直接在集群上运行?
-
代码sn-p直接在集群上。我怎么能从我的 PyCharm 运行它? @AlexOtt
标签: python apache-spark azure-databricks databricks-connect databricks-sql