【发布时间】:2016-09-25 04:50:59
【问题描述】:
我正在尝试从数据框中删除行序列,该序列以已知字符串开头,以已知字符串结尾,但中间行的内容和数量未知。我想在整个数据框上迭代它。
例如,如果数据框如下,我想从 StringA 的所有实例中删除行到 StringB(包括),但保留 StringB 后面的行直到 StringA 的下一次重复;对于下面的示例,即我想删除包含StringA,unknownC,unknownD,unknownS,StringB的行,但保留unknownK和unknownR,然后在StringA,unknownU,unknownP,StringB处继续删除,但保留unknownT。
Column 1 Column 2
StringA 1
unknownC 9
unknownD 11
unknownS 5
StringB 7
unknownK 6
unknownR 1
StringA 76
unknownU 2
unknownP 41
StringB 3
unknownT 9
我试过df2 <- df[1:which(df[,1]=="StringA")-1,],这是不正确的,但我不知道还有什么其他方法可以尝试。提前感谢您的任何指导。
【问题讨论】:
-
是否确定 stringA 总是与后续的 stringB 配对?是否也确定字符串 A 和 B 总是交替出现(例如,从不 A...A...B)?
-
是的。它永远是 A...B,永远不会是 A..A...B