【发布时间】:2016-12-17 19:39:35
【问题描述】:
我正在从 json 文件中读取一些数据并将其转换为我用来将数据发送到 hive 的字符串。
数据在 Hive 中正常到达,但它被分配到错误的列,我做了一个小例子
在 Hive 中:
Table name = TestTable, Column1 = test1, Column2 = test2`
我的代码:
data = hiveContext.sql("select \"hej\" as test1, \"med\" as test2")
data.write.mode("append").saveAsTable("TestTable")
data = hiveContext.sql("select \"hej\" as test2, \"med\" as test1")
data.write.mode("append").saveAsTable("TestTable")
这导致"hej" 两次出现在test1 中,"med" 两次出现在test2 中,而不是每次出现一个。
它似乎总是按书写顺序显示,而不是进入我用'as' 关键字提到的列。
有人有什么想法吗?
【问题讨论】:
标签: apache-spark hive apache-spark-sql