【发布时间】:2021-11-22 02:19:59
【问题描述】:
我有一个如下所示的 csv 文件
name, state, a, b, c, d, ..., x
Jon, NY, 1, 4, 6, 2, 6
Eric, CA, 5, 3, 1, 5, 6
Chris,LA, 4, 4, 3, 1, 5
我想要以下结果(一列带有连接字段(inkl 标题名称))
concate-fields
"name=Jon, state=NY, a=1, b=4, c=6, d= 2, ... x=6"
"name=Eric, state=CA, a=5, b=3, c=1, d= 5, ... x=6"
"name=Chris, state=LA, a=4, b=4, c=3, d= 1, ... x=5"
a...>x 中可能有很多标头,因此应以通用方式附加这些标头
我现在有
import org.apache.spark.sql.functions.{concat, lit}
val lp = sample.select(concat(lit("name), $"name", lit(",state="), $"state")
display(lp)
但我无法为列 a->x 添加相同的内容(因为这需要以通用方式完成)
【问题讨论】:
标签: scala dataframe apache-spark concatenation databricks