【发布时间】:2023-02-24 15:01:17
【问题描述】:
如果我有这样的数据框:
Time X Y
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.634508 200 10.1
2023-02-01T15:03:02.634508 200 10.1
2023-02-01T15:03:02.943522 200 10.1
2023-02-01T15:03:02.943522 200 10.1
我只想删除重复的 PAIRS。即第一对和第二对 .565333 时间戳实际上是唯一的,但是像 t[~t.duplicated()] 这样的操作将删除所有重复项,如下所示:
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.634508 200 10.1
2023-02-01T15:03:02.943522 200 10.1
而我想要这个:
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.565333 200 10.1
2023-02-01T15:03:02.634508 200 10.1
2023-02-01T15:03:02.943522 200 10.1
【问题讨论】:
-
您是否反对手动遍历数据框来确定对?他们总是背靠背吗?
标签: python pandas dataframe duplicates data-cleaning