【发布时间】:2022-01-15 16:25:06
【问题描述】:
我有三个大小为 df1=(176, 5766) df2=(8, 5766) df3=(16, 5766) 的数据框,尽管列名不同,但在我的列中存在相似的数据值(所有列在每三个都相等),但是当我使用例如
df1.T.drop_duplicates().T
df2.T.drop_duplicates().T
df3.T.drop_duplicates().T
虽然它必须创建相同的输出列,但它会将 df1=(176, 581) df2=(8, 632) df3=(16, 622) 我怎样才能驾驭这个?
【问题讨论】:
-
您的意思是要保留所有 3 个数据框中存在的列并从所有数据框中删除其余列?所以基本上你在所有这些中留下了相同数量的列?
-
不,我的意思是我想删除值列(不是名称列)方面的相似列,因为所有三个数据框都是相似的列,但只是行号不同。但是当您等待时,通过上述方法删除相似列后,它们在输出中的列号必须相同,但不是?
标签: python python-3.x pandas dataframe duplicates