【发布时间】:2021-12-24 19:32:14
【问题描述】:
我是 databricks 的新手,我在 Python 中使用 databricks,我创建了一个 json 文件的架构,结果数据框 (display(result)) 给出了以下结果:
docs
-------
[
{
"id": 1,
"name": "product 1",
"brand": "new 1",
"val": [
{
"value": "test 1"
},
{
"value": "test 2"
},
{
"value": "test 3"
},
{
"value": "test 1"
}
]
},
{
"id": 2,
"name": "product 2",
"brand": "new 2",
"val": [
{
"value": "test 1"
},
{
"value": "test 2"
},
{
"value": "test 3"
},
{
"value": "test 1"
}
]
},
{
"id": 3,
"name": "product 3",
"brand": "new 3",
"val": [
{
"value": "test 1"
},
{
"value": "test 2"
},
{
"value": "test 3"
},
{
"value": "test 1"
}
]
}
]
而我正在寻找的是如何将这些数据放在单独的列中,例如:
id name brand val
1. product 1 new 1. [{"value":"test 1"},...]
2. product 2. .... ....
等等.. 请问有没有办法在databricks中使用python来做到这一点?
【问题讨论】:
-
可以分享
result数据框的架构吗?
标签: pyspark databricks azure-databricks