【发布时间】:2017-10-08 12:36:13
【问题描述】:
在我的DataFrame中,有列分别包含null和NaN的值,如:
df = spark.createDataFrame([(1, float('nan')), (None, 1.0)], ("a", "b"))
df.show()
+----+---+
| a| b|
+----+---+
| 1|NaN|
|null|1.0|
+----+---+
它们之间有什么区别吗?如何处理?
【问题讨论】:
标签: python apache-spark null pyspark nan