【发布时间】:2019-09-23 04:56:46
【问题描述】:
我试图应用 UDF 函数来舍入这些 pct,也许有更好的方法,我对此持开放态度,因为我是 pyspark 的新手。 当我删除 udf 函数以放弃对数字进行四舍五入时,它起作用了,因此我对数据框充满信心。
所以各位,天才,请帮助我,爱与和平
我在 databricks 中尝试了 spqrk.sql 来获取这个数据框,它看起来不错。
代码如下:
from pyspark.sql.types import IntegerType
round_func = udf(lambda x:round(x,2), IntegerType())
q2_res = q2_res.withColumn('pct_DISREGARD', round_func(col('pct')))
display(q2_res)
错误: AttributeError: 'NoneType' 对象没有属性 '_jvm'
【问题讨论】:
标签: pyspark