【发布时间】:2017-09-28 13:13:56
【问题描述】:
我有以下数据:
userid itemid
1 1
1 1
1 3
1 4
2 1
2 2
2 3
我想删除查看相同 itemID 超过或等于两次的用户 ID。 例如,userid=1 已经查看了 itemid=1 两次,因此我想删除 userid=1 的整个记录。但是,由于 userid=2 没有两次查看相同的项目,所以我将保留 userid=2 的原样。
所以我希望我的数据如下所示:
userid itemid
2 1
2 2
2 3
有人可以帮我吗?
import pandas as pd
df = pd.DataFrame({'userid':[1,1,1,1, 2,2,2],
'itemid':[1,1,3,4, 1,2,3] })
【问题讨论】:
-
请发布创建该数据的可重现代码。
标签: python pandas group-by duplicates threshold