【发布时间】:2021-11-10 19:20:25
【问题描述】:
我有 2 个不同大小的数据框。第一个数据框(df1)有 4 列,但其中两列与第二个数据框(df2)中的列同名,后者仅由 2 列组成。共同的列是['ID'] 和['Department']。
我想检查df2 中的ID 是否在df1 中。如果是这样,我想用df2['Department'] 值替换df1['Department'] 值。
例如,df1 看起来像这样:
ID Department Yrs Experience Education
1234 Science 1 Bachelors
2356 Art 3 Bachelors
2456 Math 2 Masters
4657 Science 4 Masters
df2 看起来像这样:
ID Department
1098 P.E.
1234 Technology
2356 History
我想检查来自df2 的ID 是否在df1 中,如果是,请更新Department。输出应如下所示:
ID Department Yrs Experience Education
1234 **Technology** 1 Bachelors
2356 **History** 3 Bachelors
2456 Math 2 Masters
4657 Science 4 Masters
df1 的预期更新以粗体显示
有没有有效的方法来做到这一点?
感谢您抽出宝贵时间阅读本文并提供帮助。
【问题讨论】:
-
您能否编辑您的问题并将示例输入数据框
df1、df2和预期输出放在那里? -
@AndrejKesely 我刚刚编辑了它
-
编辑问题以将
df2的样本数据改进为更真实的数据,其中匹配项的行索引不一定与df1索引相同。
标签: python pandas dataframe duplicates dataset