【发布时间】:2018-08-07 11:14:14
【问题描述】:
我有一个包含数千行的数据框,我正在寻找的是分组并计算一列,然后按输出排序:我所做的事情看起来像:
import org.apache.spark.sql.hive.HiveContext
import sqlContext.implicits._
val objHive = new HiveContext(sc)
val df = objHive.sql("select * from db.tb")
val df_count=df.groupBy("id").count().collect()
df_count.sort($"count".asc).show()
【问题讨论】:
标签: scala apache-spark