【发布时间】:2016-11-14 03:27:42
【问题描述】:
我正在尝试在如下嵌套字段上调用 partitionBy:
val rawJson = sqlContext.read.json(filename)
rawJson.write.partitionBy("data.dataDetails.name").parquet(filenameParquet)
我在运行它时收到以下错误。我确实看到“名称”列为以下架构中的字段。是否有不同的格式来指定嵌套的列名?
java.lang.RuntimeException: 在模式 StructType(StructField(name,StringType,true), StructField(time,StringType,true), StructField(data,StructType(StructField(dataDetails, StructType(StructField(name,StringType,true), StructField(id,StringType,true),true)),true))
这是我的 json 文件:
{
"name": "AssetName",
"time": "2016-06-20T11:57:19.4941368-04:00",
"data": {
"type": "EventData",
"dataDetails": {
"name": "EventName"
"id": "1234"
}
}
}
【问题讨论】:
-
我也遇到了同样的问题,你解决了吗?
标签: apache-spark apache-spark-sql spark-dataframe