【发布时间】:2019-03-18 20:03:55
【问题描述】:
我有一个DataFrame,我正在尝试partitionBy 一个列,按该列对其进行排序并使用以下命令以镶木地板格式保存:
df.write().format("parquet")
.partitionBy("dynamic_col")
.sortBy("dynamic_col")
.save("test.parquet");
我收到以下错误:
reason: User class threw exception: org.apache.spark.sql.AnalysisException: 'save' does not support bucketing right now;
save(...) 不允许吗?
是否只允许 saveAsTable(...) 将数据保存到 Hive?
任何建议都有帮助。
【问题讨论】:
标签: apache-spark apache-spark-sql partitioning parquet