【发布时间】:2015-11-09 16:48:22
【问题描述】:
我有一个如下的DataFrame A,我想在它们的前3列中找到具有相同值的行。
import pandas as pd
import io
import numpy as np
import datetime
A= """
c0 c1 c2 c3 c4
0 1 a d 3 4
1 1 a c 0 0
2 1 a d 3 1
3 1 b c 0 0
4 2 b d 8 5
5 2 b d 3 3
"""
df = pd.read_csv(io.StringIO(A), delimiter='\s+')
df2= pd.DataFrame(df, columns=['c0', 'c1', 'c2'])
for i in range(0,4):
row1 = df2.irow(i)
row2 = df2.irow(i+1)
val=all(unique_columns = row1 != row2)
print(i)
我希望它打印2, 5。
好吧,这不起作用,即使它无法获取彼此跟随的行。
或者,我尝试了np.unique(df2),看看列数是否与df2不同,这也不起作用。
感谢任何帮助。
【问题讨论】:
-
...但只有第 2 行在 c0-c2 中的值与第 0 行相同,第 6 行没有。
-
@CTZhu,是的,但是第 5 行的值与第 4 行的值相同。
标签: python numpy pandas dataframe