【发布时间】:2018-02-22 22:22:03
【问题描述】:
我有两个数据框,一个包含喜欢歌曲的客户,另一个数据框包含用户及其集群。
数据 1:
user song
A 11
A 22
B 99
B 11
C 11
D 44
C 66
E 66
D 33
E 55
F 11
F 77
数据 2:
user cluster
A 1
B 2
C 3
D 1
E 2
F 3
使用上述数据集,我能够实现该集群的用户所听的所有歌曲。
cluster songs
1 [11, 22, 33, 44]
2 [11, 99, 66, 55]
3 [11,66,88,77]
我需要将特定集群的歌曲分配给尚未听过的特定用户。 在我的预期输出中,A 属于集群 1,他还没有听过第 33 和 44 首歌曲。所以我的输出应该如下所示。 B 同理,属于集群 2,B 没有听过 66 和 55 首歌曲,B 的输出如下所示。
预期输出:
user song
A [33, 44]
B [66,55]
C [77]
D [11,22]
E [11,99]
F [66]
【问题讨论】:
标签: python pandas pandas-groupby