【发布时间】:2017-04-03 17:00:44
【问题描述】:
我不想使用 databricks API,因为我们遇到了一些问题。
我想在 java 1.7、Spark 1.6.2 中将 DF 转换为 RDD 并从 RDD 转换为 textfile
我希望我的数据框保存为文本文件,因为我知道如果我们使用 Java 1.8,以下代码可以工作
df.rdd.map(row => row.mkString("\t")).coalesce(1).saveAsTextFile("outputDirRdd")
但我试图在 Java 1.7 中使用相同的上述代码,但我无法获得正确的语法并使用以下代码。
df.toJavaRDD().map(new Function<???,???>() {
public ??? call(?? input) throws Exception {
?????
}
}).coalesce(1).saveAsTextFile("/s/filelocation");
我不知道上面的代码是否正确。
请帮助我,在此先感谢。
【问题讨论】:
标签: java hadoop apache-spark apache-spark-sql spark-dataframe