【发布时间】:2017-05-18 19:09:58
【问题描述】:
我有一个 pandas 数据框,它包含两列,跟踪号 [col_1] 和 ID 号 [col_2]。跟踪号可以重复,ID 号也可以重复 - 但是,每个跟踪和 ID 应该只对应相邻列中的特定人员。
我的两列都是一样长,但是唯一值计数不同,应该是一样的,如下图:
in[1]: Trace | ID
1 | 5054
2 | 8291
3 | 9323
4 | 9323
... |
100 | 8928
in[2]: print('unique traces: ', df['Trace'].value_counts())
print('unique IDs: ', df['ID'].value_counts())
out[3]: unique traces: 100
unique IDs: 99
在上面的代码中,相同的 ID 号 (9232) 由两个跟踪号 (3 和 4) 表示 - 我如何隔离这些事件?感谢收看!
【问题讨论】:
-
我是否正确,您想查找重复项?如果是这样,你想要行号还是重复的
ID? -
@MSeifert - 首选行号。谢谢!
标签: python python-3.x pandas dataframe