【发布时间】:2016-10-31 11:09:37
【问题描述】:
我想将 df 保存为分区镶木地板,因为逐条插入记录需要时间。任何人都可以帮助我如何保存它并指向蜂巢表。
【问题讨论】:
-
实际上我一直在增量获取数据,我正在使用动态分区,而不是插入我想要直接保存的数据,作为由一列分区的镶木地板。
标签: scala apache-spark spark-dataframe hiveql
我想将 df 保存为分区镶木地板,因为逐条插入记录需要时间。任何人都可以帮助我如何保存它并指向蜂巢表。
【问题讨论】:
标签: scala apache-spark spark-dataframe hiveql
df.write.parquet("/parquet/file/path")
然后你可以创建一个Hive external table 指向 parquet 文件位置。
【讨论】: