【发布时间】:2021-11-04 14:50:00
【问题描述】:
我正在尝试批量写入 AWS DynamoDB,我必须在加载之前重新格式化数据帧,现在我的问题是如何将深度 structType 数据帧转换为 DynamoDB 可以识别的深度 Map 格式,并且不需要定义字段手动字段?
环境:Databricks 中的 Apache Spark 2.4.3/Spark 2.4.3、Scala 2.11、DynamoDB
来源具有如下深层结构
root
|-- PK: string (nullable = false)
|-- SK: string (nullable = false)
|-- ee: struct (nullable = false)
| |-- kv: struct (nullable = false)
| | |-- ss: map (nullable = true)
| | |-- pp: struct (nullable = true)
| | | |-- gg: string (nullable = true)
| | | |-- nn: struct (nullable = true)
| | | | |-- mm: string (nullable = true)
| | |-- ll: array (nullable = true)
| | | |-- le: struct (containsNull = true)
| | | | |-- lep: struct (nullable = true)
我找到了一些示例,但通常它们只能处理 1-2 级嵌套结构,但我的 dataFrame 在这种情况下“更深”。
【问题讨论】:
标签: scala apache-spark amazon-dynamodb