【问题标题】:Duplicate columns in spark read jsonspark读取json中的重复列
【发布时间】:2017-06-28 04:55:15
【问题描述】:

我在一个扁平结构的 json 文件上运行了spark.read.json(json_file_path)

我收到错误消息:

Reference 'col' is ambiguous, could be: col#29582L, col#29632

这可能是由于另一列的名称不同:Col。如果无法修改 json 数据,如何解决?

【问题讨论】:

    标签: json apache-spark apache-spark-sql


    【解决方案1】:

    参考R case of the problem并搜索配置后。

    我找到了

    spark.conf.set("spark.sql.caseSensitive", "true")
    

    来自https://databricks.com/blog/2016/08/15/how-to-use-sparksession-in-apache-spark-2-0.html

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2021-05-27
      • 2018-07-15
      • 1970-01-01
      • 2018-07-17
      • 2021-05-10
      • 2020-10-14
      • 2019-07-31
      • 2020-01-01
      相关资源
      最近更新 更多