【发布时间】:2016-08-09 05:28:24
【问题描述】:
我有一个 cassandra 表 person_master (personId: int, 客户 ID:整数, 名字:字符串, 姓氏:字符串, mrids: 设置)primaryKey(personId 和 customerID)
假设我有一个结构 [personId, customerId, firstName, lastname, messageType: String, source: String, sourceType: String] 的输入 RDD
假设RDD的值:[1001,119,None,None,{abc.xyz} 并且 cassandra 行的值为 [1001,119,Vikash,Singh,{aaa.bbb}]
我想根据 RDD 值获取 cassandra 行并更新 cassandra 表的 mrids 列并使用 cassandra 行中的所有其他列。
例如在此我希望最终的 RDD 值为 [1001,119,Vikash,Singh,{aaa.bbb,abc.xyz}],稍后我将更新为 cassandra。
谁能给我使用 cassandra 连接器在 Spark 中执行此操作的解决方案。
【问题讨论】:
标签: scala apache-spark cassandra apache-spark-sql spark-cassandra-connector