【发布时间】:2018-08-07 18:45:00
【问题描述】:
我正在做一个单元测试,我需要创建一个RDD[(ImmutableBytesWritable, Result)]。数据只包含一个唯一的id 和一个非唯一的value 列。
我可以使用toDF 从列表中创建一个DataFrame,并将其转换为RDD[Row];但我无法将其映射到 RDD[(ImmutableBytesWritable, Result)]。
val values = List((1, 1234), (2, 123), (3, 1234))
import spark.implicits._
val df = values.toDF("id", "value")
val counts : RDD[(ImmutableBytesWritable, Result)] = df.rdd.map(
row => (new ImmutableBytesWritable(), Result.create(...))
)
谢谢!
【问题讨论】:
-
你能发布你到目前为止的代码吗?
-
@Jeremy 是的,好电话。
-
什么是结果?
-
@Jeremy 这是
org.apache.hadoop.hbase.client.Result
标签: scala apache-spark hbase rdd