【发布时间】:2022-11-10 14:26:39
【问题描述】:
我有一个可以覆盖 Cosmos 中文档的 spark notebook。其中一些文档具有在保存到 Cosmos 时未序列化的空字段,而其他文档则具有这些字段的数据。当我将数据帧写回 Cosmos 时,我最终会得到具有空字段的文档。
有没有办法不为该值为空的行序列化该列?
例子
Cosmos 中存在的文档:
{
"id": "7b354753-e817-41f5-848d-780dab44d179",
"pk": "20763ae4-8394-467d-ba3c-5ab363c40f90",
"documentType": "ExampleDocument",
"userId": "20763ae4-8394-467d-ba3c-5ab363c40f90",
"label": "Needs to be updated"
}
被覆盖后的文件:
{
"id": "7b354753-e817-41f5-848d-780dab44d179",
"pk": "20763ae4-8394-467d-ba3c-5ab363c40f90",
"documentType": "ExampleDocument",
"userId": "20763ae4-8394-467d-ba3c-5ab363c40f90",
"label": "Updated With Spark",
"details": null
}
我仍然希望details 字段被序列化,但仅适用于它不为空的文档。
【问题讨论】:
标签: azure pyspark azure-cosmosdb