【发布时间】:2017-03-02 18:48:20
【问题描述】:
我必须从 S3 读取某些文件,因此我创建了一个包含这些文件在 S3 上的路径的 CSV。我正在使用以下代码读取创建的 CSV 文件:
val listofFilesRDD = sparkSession.read.textFile("s3://"+ file)
这工作正常。 然后我尝试读取每个路径并创建数据框,例如:
listofFilesRDD.foreach(iter => {
val pathDF = sparkSession.read
.schema(testSchema)
.option("headers", true)
.csv("s3://"+iter)
pathDF.printSchema()
})
但是,上面的代码给出了 NullPointerException。
那么,我该如何修复上面的代码?
【问题讨论】:
标签: scala apache-spark amazon-s3 spark-dataframe bigdata