【发布时间】:2020-12-01 03:48:42
【问题描述】:
给定一个数据集如下:
name month year
0 Joe December 2017
1 James January 2018
2 Bob April 2018
3 Joe December 2017
4 Jack February 2018
5 Jack April 2018
我需要根据 Pandas 中的 month 和 year 列过滤和显示所有重复的行。
使用下面的代码,我得到:
df = df[df.duplicated(subset = ['month', 'year'])]
df = df.sort_values(by=['name', 'month', 'year'], ascending = False)
输出:
name month year
3 Joe December 2017
5 Jack April 2018
但我想要的结果如下:
name month year
0 Joe December 2017
1 Joe December 2017
2 Bob April 2018
3 Jack April 2018
我怎么能在 Pandas 中做到这一点?
【问题讨论】:
-
这能回答你的问题吗? How do I get a list of all the duplicate items using pandas in python?您打开了一个新问题并在没有检查它是否已经存在的情况下回答了它?
-
似乎没有检查基于多列的重复
标签: python-3.x pandas dataframe