【发布时间】:2017-11-30 23:23:08
【问题描述】:
我打算修改一列Spark Dataframe来实现下面Hive QL的类似目的:
SELECT Id, MIN(Id) over (PARTITION BY Age) Rep FROM Employees
我的问题是如何在 UDF 中实现“over (partition by ..)”?
我的电话是这样的:
def _udfuntion = { ... }
val ownfunc = udf(_udfunction)
df.withColumn("Rep", ownfunc($"Id", $"Age"))
【问题讨论】: