【发布时间】:2017-05-01 13:11:26
【问题描述】:
我有一个已映射为列表的 spark RDD (myData)。 myData.collect() 的输出产生以下结果:
['x', 'y', 'z']
我可以对 myData 执行什么操作来映射或创建一个包含 xyz 所有排列列表的新 RDD?例如 newData.collect() 会输出:
['xyz', 'xzy', 'zxy', 'zyx', 'yxz', 'yzx']
我尝试过使用笛卡尔(myData) 的变体,但据我所知,最好的结果是二值对的不同组合。
【问题讨论】:
标签: python list apache-spark pyspark permutation