【发布时间】:2019-07-02 23:51:30
【问题描述】:
我有以下变量
id1 = c(1,1,1,2,3,4,4,5)
id2 = c(1,1,2,2,3,3,4)
digit1 = c(243, 888, 343, 276, 493, 024, 305, 093)
digit2 = c(343, 756, 947, 089, 390, 930, 024)
df1 = data.frame(id1, digit1)
df2 = data.frame(id2, digit2)
我正在寻找一种方法来查看基于相似 ID 的数字 1 与数字 2 有多少匹配。给定 id 的频率在同一数据帧内以及与其他数据帧相比时可能会有所不同。
如果 id1 的频率高于给定 id 的 id2 频率,我不希望它计算额外的不正确或正确。例如,将 df1 中的前三位数字与 df2 中的仅前两位数字进行比较时,返回向量会将其计为 1 个正确、1 个不正确和 1 个 NA。我正在尝试合并两个数据框并为匹配结果添加新列。
在对齐 df1 和 df2 中的列并合并到一个新的数据帧之后,我想在新的数据帧中添加一个像 (0, NA, 1, 0, 0, 1, NA, NA) 这样的向量。
我将使用的实际数据对于每个数据帧都有数千行
【问题讨论】:
标签: r