【发布时间】:2021-10-12 05:49:42
【问题描述】:
我在 R 的数据框中有一列包含样本名称。有些名称是相同的,只是它们以 A 或 B 结尾,有些样本会重复自己,如下所示:
df <- data.frame(Samples = c("S_026A", "S_026B", "S_028A", "S_028B", "S_038A", "S_040_B", "S_026B", "S_38A"))
我要做的是隔离所有末尾有 A 和 B 的样本名称,而不包括只有 A 或 B 的样本名称。
我正在寻找的最终结果如下所示: "S_026" 和 "S_028" 因为它们是唯一的以 A 和 B 结尾的。
我似乎发现的只是如何删除重复项,在这种情况下,删除重复项只会给我“S_026B”和“S_38A”。
或者,我尝试在最后去除 A 和 B,然后将这些名称中的每一个总和 > 2 的次数相加,但同样,这并没有给我想要的结果。
有什么建议吗?
【问题讨论】: