【发布时间】:2018-12-26 06:10:18
【问题描述】:
我正在使用 Spark 2.3,并使用 jdbc 从 MySQL 加载数据,如下所示
val dataSet:Dataset[Row] = _spark
.read
.format("jdbc")
.options(Map("url" -> jdbcUrl
,"user" -> username
,"password" -> password
,"dbtable" -> dataSourceTableName
,"driver" -> driver
))
.load()
我想根据表中的特定列对数据集进行分区。 我怎样才能做到这一点?
【问题讨论】:
标签: apache-spark apache-spark-sql