【问题标题】:python panda dataframe: argument 'keep' not working in drop_duplicates()/duplicatedpython panda数据框:参数'keep'在drop_duplicates()/duplicated中不起作用
【发布时间】:2016-05-11 21:30:36
【问题描述】:

假设我们有一个数据框df

df=pd.DataFrame()
df['c1']=[1,2,3,3,4]
df['c2']=["a1","a2","a2","a2","a1"]
df['c3']=[1,2,3,3,5]

如果我使用df.drop_duplicates(keep=False)df.duplicated(keep=False),我会收到以下错误:

File "C:\Users\Kanika\Anaconda\lib\site-packages\pandas\util\decorators.py", line 88, in wrapper
return func(*args, **kwargs)

TypeError: duplicated() got an unexpected keyword argument 'keep'

【问题讨论】:

标签: python pandas dataframe duplicates


【解决方案1】:

你应该更新你的 pandas 版本,因为它是从0.17.0 版本,what's new in v. 0.17.0 添加的:

  • drop_duplicatesduplicated 现在接受 keep 关键字来定位 第一个、最后一个和所有重复项。

两者都适用于 pandas 0.18.1

In [116]: df
Out[116]:
   c1  c2  c3
0   1  a1   1
1   2  a2   2
2   3  a2   3
3   3  a2   3
4   4  a1   5

In [117]: df.drop_duplicates()
Out[117]:
   c1  c2  c3
0   1  a1   1
1   2  a2   2
2   3  a2   3
4   4  a1   5

In [118]: df.drop_duplicates(keep=False)
Out[118]:
   c1  c2  c3
0   1  a1   1
1   2  a2   2
4   4  a1   5

【讨论】:

    猜你喜欢
    • 2021-09-16
    • 2018-03-11
    • 1970-01-01
    • 2017-04-01
    • 2019-05-28
    • 2019-11-02
    • 2019-09-21
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多