【问题标题】:Drop duplicates in a dataframe PANDAS [duplicate]在数据框PANDAS中删除重复项[重复]
【发布时间】:2020-12-23 04:41:30
【问题描述】:

我有一个这样的专栏:

ID#  Username Name 
1411 at8035   Ankita
1320 mppa3    Manoj
1462 asu32    Asu
1462 asu32    Asu
1462 asu32    Asu
1488 kot3     Karla

我希望该列看起来像这样:

ID#  Username Name 
1411 at8035   Ankita
1320 mppa3    Manoj
1462 asu32    Asu
1488 kot3     Karla

只想保留重复记录的第一条或最后一条。

目前,我正在使用这个:

df.drop_duplicates(['Username','ID#'],keep='last')

但它不起作用。我有什么遗漏吗?

【问题讨论】:

  • 你说“它不工作”是什么意思?请描述问题。一种猜测:您似乎没有分配数据框或使用inplace=True,因此实际上并未对数据框进行更改

标签: python pandas duplicates


【解决方案1】:

inplace=True这样做,

 df.drop_duplicates(subset=['Username','ID#'],keep='last',inplace=True)
 print(df)

【讨论】:

    【解决方案2】:

    另一种方法是突出显示最后一个duplicated 并在过滤True 值之前还原选择

    df[~df.duplicated(subset=['Username','ID#'], keep='last')]
    
    
    
        ID# Username    Name
    0  1411   at8035  Ankita
    1  1320    mppa3   Manoj
    4  1462    asu32     Asu
    5  1488     kot3   Karla
    

    【讨论】:

      猜你喜欢
      • 2020-11-09
      • 1970-01-01
      • 2021-12-06
      • 1970-01-01
      • 2016-10-01
      • 2019-05-12
      • 2021-02-24
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多