【发布时间】:2022-01-22 19:18:23
【问题描述】:
我得到了一个类似这样的 json 文件。
"code": 298484,
"details": {
"date": "0001-01-01",
"code" : 0
}
code 出现两次,一个是满的,一个是空的。我需要第一个详细的数据。 pyspark中的方法是什么?
我试图过滤
df = rdd.map(lambda r: (r['code'], r['details'])).toDF()
但它显示_1, _2(无架构)。
【问题讨论】: