【发布时间】:2019-05-22 07:43:28
【问题描述】:
我正在尝试从 AWS S3 读取 .xls 文件,但收到 java.io.FileNotFoundException 异常。
我尝试了以下两种方法。一种方法是在 option() 中提供带有关键位置的路径,另一种方法是在 load() 中添加相同的路径。
Dataset<Row> segmentConfigData = spark.read()
.format("com.crealytics.spark.excel")
.option("sheetName", "sheet1")
.option("header","true")
.option("location","s3a://input/552SegmentConfig.xls")
.option("useHeader", "true")
.option("treatEmptyValuesAsNulls", "true")
.option("inferSchema", "true")
.option("addColorColumns", "False")
.load();
Dataset<Row> segmentConfigData = spark.read()
.format("com.crealytics.spark.excel")
.option("sheetName", "sheet1")
.option("header","true")
.option("location","s3a://input/552SegmentConfig.xls")
.option("useHeader", "true")
.option("treatEmptyValuesAsNulls", "true")
.option("inferSchema", "true")
.option("addColorColumns", "False")
.load("s3a://input/552SegmentConfig.xls");
我得到文件未找到异常。同样,当我读取 .csv 文件时,我能够读取该文件。
编辑-我已经解决了这个问题。我使用的是旧版本的“com.crealytics.spark.excel”。一旦我取消了罐子的等级,我就可以准备好了。
但现在我面临另一个问题。除了第一张纸之外,我无法阅读任何其他纸。有什么帮助吗?
【问题讨论】:
标签: java amazon-s3 apache-spark-sql dataset