【发布时间】:2020-04-22 00:35:34
【问题描述】:
我正在尝试使用 Schema 加载 JSON 文件,但是 schema 的列都是小写的,并且 JSON 文件中的键不是,所以加载的数据为 null。
我可以使用推断的架构加载文件,但这不是一个选项。
我也尝试过设置spark.sql.caseSensitive=true,但它不起作用,而是将它们添加为新列。
是否可以设置任何属性以使其工作,或者我必须在加载到 spark 之前预处理所有这些 JSON 文件。
JSON 可能缺少键值。
例如
{"id": "0001","type": "donut"}
{"Id": "0002","Type": "Cakedonut"}
{"ID": "0002"}
【问题讨论】:
标签: scala apache-spark