【发布时间】:2018-12-18 16:05:45
【问题描述】:
我正在使用 Kryo 编码器将 GenericRecords 编码为 spark DataFrame,并且正在将数据帧写入 Avro 文件。一旦我尝试从 Hive 读取文件,我收到一条错误消息,指出解析器找到了 toplevelrecord 而不是预期的字段。这条记录不在我现有的模式中,我认为它是在我使用 spark-avro 编写时创建的。我想知道是否/如何从 avro 文件中删除它。
这就是它的样子:
{
"type":"record",
"name":"topLevelRecord",
"fields":[
{
"name":"value",
"type":["bytes","null"]
}
]
}
【问题讨论】:
标签: java apache-spark record avro