【发布时间】:2019-03-28 18:50:38
【问题描述】:
这里有 2 个数据框:
df1 <- data.frame(ID=c(1,2,3,4))
df1
df2 <- data.frame(ID=c(1,3))
df2
我怎样才能加入他们以获得以下输出?:
# ID.1 ID.2
# 1 1
# 2
# 3 3
# 4
谢谢!
【问题讨论】:
-
你想加入什么?这是您遇到的实际问题,还是您的实际数据集有一个 ID 列,您可以对其进行正常连接?
-
我正在尝试加入 ID 列。我应该提到,如果可能的话,我正在寻找一个 dplyr 解决方案。但是 dplyr 连接似乎总是默认删除重复的列,所以我无法得到我正在寻找的输出。
-
为什么要复制该列,因为它不包含其他地方没有的信息?
-
感谢您的提问 - 第二列代表客户 ID 的子集,例如“女性” - 我需要指出这一点。因此,我使用第二列来标记第一列中的客户。我曾想过使用 mutate 操作而不是 join,但我的第二个数据框中有数千万行,所以我认为 join 会更有效。