【发布时间】:2022-01-09 02:00:27
【问题描述】:
我正在编写一份报告,在该报告中我比较了基金 ID,以查找跨数据帧的(公司名称、ID)配对之间的任何差异。下表:
| Company | ID |
|---|---|
| A | 123 |
| B | 456 |
| C | 789 |
和
| Company | ID |
|---|---|
| B | 453 |
| A | 123 |
| C | 789 |
在这种情况下,理想情况下,有一些函数可以读取每个公司名称,识别每个相应的 ID,然后从下一个表中找到具有相应 ID 的相同公司名称。如果它们是相同的值,我假设它会返回 TRUE,如果不同,则返回 FALSE。
在上面的示例中,它将返回 TRUE、FALSE、TRUE,因为唯一的差异是与 B 公司的差异。
我认为它一定是 sapply 的一些嵌套变体,但对于我的一生,我无法弄清楚语法是什么(因为公司将位于不同的行)。
【问题讨论】:
-
与Is there an R function for finding the index of an element in a vector? 几乎相同。
paste(df1$company, df1$ID) %in% paste(df2$company, df2$ID)应该做的工作。 -
您的措辞含糊不清。您是否保证只有 2 张桌子,还是需要容纳更多?
标签: r dataframe validation dplyr