【发布时间】:2022-10-18 00:09:04
【问题描述】:
我是 Databricks 的新手,我有一个要求,在转换后的银层中,我必须从我的数据集中获取 max(load_date) 并更新存储帐户(瞬态文件夹)中的值。 Transient 文件夹中已经有一个 .csv 文件,每次我的笔记本运行时我都必须覆盖 max(load_date) 值。
现在我正在创建一个空的数据框,然后分配最大日期,然后将其加载到文件中,但它似乎不是那样工作的。 任何想法以有效的方式做到这一点?
【问题讨论】:
-
您需要解释您到底在做什么(架构、代码)以及问题到底是什么(错误或数据与预期)。
标签: pyspark databricks azure-databricks azure-data-lake-gen2