【发布时间】:2019-12-03 13:48:52
【问题描述】:
我想从现有的数据框创建一个新的数据框。我的 df 看起来像这样:
X Y
12 ABC_SS
23 B49
45 G56_SS
我想对只有 Y 值且 Y 中包含“_SS”的新数据集进行子集化。请问我该怎么做?
这不起作用:
newdf <-subset(df,df$Y %in% "_SS")
【问题讨论】:
我想从现有的数据框创建一个新的数据框。我的 df 看起来像这样:
X Y
12 ABC_SS
23 B49
45 G56_SS
我想对只有 Y 值且 Y 中包含“_SS”的新数据集进行子集化。请问我该怎么做?
这不起作用:
newdf <-subset(df,df$Y %in% "_SS")
【问题讨论】:
我们可以在base R中使用grepl来匹配子串
subset(df, grepl("_SS", Y))
或者另一个选项是filter
library(dplyr)
library(stringr)
df %>%
filter(str_detect(Y, "_SS$"))
【讨论】: