【问题标题】:How to print original and duplicate rows one by one using python如何使用python一一打印原始行和重复行
【发布时间】:2020-05-21 14:45:47
【问题描述】:

我有一个这样的重复行的数据框
0 乔 2017 年 12 月
1 詹姆斯 2018 年 1 月
2 鲍勃 2018 年 4 月
3 杰克 2018 年 3 月
4 乔 2017 年 12 月
5 杰克 2018 年 3 月

使用 df[df.duplicated(keep=False)] 后,我得到类似这样的输出,
0 乔 2017 年 12 月
3 杰克 2018 年 3 月
4 乔 2017 年 12 月
5 杰克 2018 年 3 月

我需要得到这样的输出,
0 乔 2017 年 12 月
3 乔 2017 年 12 月
4 杰克 2018 年 3 月
5 杰克 2018 年 3 月

请帮我解决这个问题。提前致谢。

【问题讨论】:

    标签: python pandas


    【解决方案1】:

    给出df和column,0在索引中,

    |   0 | 1     | 2        |    3 |
    |----:|:------|:---------|-----:|
    |   0 | Joe   | December | 2017 |
    |   1 | James | January  | 2018 |
    |   2 | Bob   | April    | 2018 |
    |   3 | Joe   | December | 2017 |
    |   4 | Jack  | March    | 2018 |
    |   5 | Jack  | March    | 2018 |
    

    duplicated 与参数keep=False 和布尔索引一起使用:

    df[df.duplicated(keep=False)]
    

    输出:

    |   0 | 1    | 2        |    3 |
    |----:|:-----|:---------|-----:|
    |   0 | Joe  | December | 2017 |
    |   3 | Joe  | December | 2017 |
    |   4 | Jack | March    | 2018 |
    |   5 | Jack | March    | 2018 |
    

    【讨论】:

    • 嘿,谢谢你的帮助,我已经编辑了我的问题,我遇到了这种问题,你能调查一下并帮助我
    • 要按年份排序吗?
    • 在索引之前对数据帧进行排序。 df.sort_values(3)[df.duplicated(keep=False)]
    猜你喜欢
    • 2013-12-13
    • 2015-07-20
    • 1970-01-01
    • 2020-04-13
    • 2019-12-11
    • 1970-01-01
    • 2015-01-01
    • 1970-01-01
    • 2021-08-25
    相关资源
    最近更新 更多