【发布时间】:2020-05-18 23:09:47
【问题描述】:
我想突出显示数据框的两个不同列中的重复数据值。 例如:
df1:
item Node
A B
A C
A D
B A
C A
我希望输出如下:
item Node Same
A B False
A C False
A D False
B A True
C A True
我想显示重复的值,例如是否有 A-B 我想突出显示 B-A。为此,我创建了另一个数据框并交换了两列的值。
df2:
item node
B A
C A
D A
A B
A C
我正在尝试检查 df1['item']==df2['node'] 和 df1['node']==df2['item'] ,如果为真,则重复该值。当 A 进入 df1 项目时,它会检查 df2 节点中的 A 并相应地检查 A 的相应节点 B 是否进入 df2 的项目列。
import pandas as pd
import numpy as np
data=pd.read_excel(r'C:\Users\eumukar\Desktop\test data xl.xlsx')
df1=pd.DataFrame(data,columns=['item','node'])
df2=pd.DataFrame(data,columns=['node','item'])
df1['Same']=np.where((df1['item']==df2['node']) & (df1['node']==df2['item']),'True','False')
print(df1)
我得到的输出是:
item node Same
A B False
A C False
A D False
B A False
C A False
【问题讨论】:
-
df1中是否可能有另一行A B?如果是,预期的输出是什么?
标签: python pandas list numpy dataframe