【发布时间】:2020-05-10 16:07:29
【问题描述】:
我正在使用 pyspark 版本 2.4.5 和 Databricks 运行时 6.5,我遇到了意外行为。我的代码如下:
import pyspark.sql.functions as F
df_A = spark.table(...)
df_B = df_A.drop(
F.col("colA")
)
df_C = df_B.filter(
F.col("colA") > 0
)
当我通过过滤 df_B 来分配 df_C 时,我预计会抛出一个错误,因为“colA”已被删除。但是当我运行这段代码时,它运行良好。这是预期的还是我错过了什么?
【问题讨论】:
标签: pyspark databricks