【发布时间】:2017-01-30 18:00:56
【问题描述】:
我已尝试使用此查询从linkedin 数据中获取所需的经验。
Dataset<Row> filteredData = spark
.sql("select full_name ,experience from (select *, explode(experience['title']) exp from tempTable )"
+ " a where lower(exp) like '%developer%'");
但是我收到了这个错误:
最后我尝试了,但我得到了更多同名的行。
Dataset<Row> filteredData = spark
.sql("select full_name ,explode(experience) from (select *, explode(experience['title']) exp from tempTable )"
+ " a where lower(exp) like '%developer%'");
请给我提示,如何将字符串数组转换为同一列中的逗号分隔字符串。
【问题讨论】:
-
你能分享更多关于代码和示例数据的信息
-
其实我是用 spark 写代码
-
谢谢,但是你可以分享你的json格式的示例代码
标签: java apache-spark apache-spark-sql bigdata