【发布时间】:2022-01-23 03:21:47
【问题描述】:
我有 2 个具有相似列的子集,但它们共有的一列是列 A。
我有左边的 df L 和右边的 df R。
我想确保在 L 中看到的列 A 的任何重复项都从 L 中删除 - 整个列。
如何做到这一点?
import pandas as pd
L_df = pd.DataFrame({'A': ['bob/is/cool', 'alice/is/cool', 'jim/is/cool'],
'view': ['A', 'B', 'B']})
R_df = pd.DataFrame({'A': ['ralf/is/cool', 'i/am/cool', 'alice/is/cool'],
'view': ['A', 'B', 'C']})
我想得到这个结果,结果是删除列 A 的重复值,并从 L 而不是 R 中获取重复值。
所以我们将alice/is/cool 的view 值设为C 而不是B,如果这有意义的话:)
输出将是
out = pd.DataFrame({'A': ['ralf/is/cool', 'i/am/cool', 'alice/is/cool', 'bob/is/cool', 'jim/is/cool'],
'view': ['A', 'B', 'C', 'A', 'B']})
【问题讨论】:
-
能否提供您的数据框样本和预期输出? :)
-
请提供mcve
-
完成 :) 希望更清楚一点?
-
能否请您添加一个您想要作为输出的df?
-
为什么
'bob/is/cool'在您想要的输出中看到'B'?
标签: python pandas duplicates