【发布时间】:2016-02-19 12:07:38
【问题描述】:
我在 scala / spark-shell 中有 4 个变量。
S1 = (a string) = "age"
S2 = (another string) = "school"
D1 = (a double) = 0.50
D2 = (another double) = 0.75
我需要像这样把它喂给蜂巢表:
系数系数
年龄 0.50
学校 0.75
我能够从 scala/spark-shell 创建表:
val hiveContext = new org.apache.spark.sql.hive.HiveContext(sc)
//后续作品
hiveContext.sql("create table students_table (factor STRING, coeff FLOAT) stored as orc")
但是,我不知道如何将这些值插入到 hive 表中。
我玩过插入和更新语句。 我也玩过数据框。 我也尝试将数据转储到 hdfs 中的文本文件中(首先将它们转换为 RDD),但格式出来的方式使我无法将其用作 hive 表的素材。
我确信我错过了如何做到这一点的整个想法。
真诚感谢任何帮助。
【问题讨论】:
标签: scala hadoop apache-spark hive apache-spark-sql