【发布时间】:2020-03-11 05:41:42
【问题描述】:
我试过了:
rdd1= sc.parallelize(["Let's have some fun.",
"To have fun you don't need any plans."])
output = rdd1.map(lambda t: t.split(" ")).map(lambda lists: (lists, len(lists)))
output.foreach(print)
输出:
(["Let's", 'have', 'some', 'fun.'], 4)
(['To', 'have', 'fun', 'you', "don't", 'need', 'any', 'plans.'], 8)
我得到了每行单词的总数。但我想要每行每个单词的计数。
【问题讨论】:
-
你想要单词的数量和出现次数吗?