【发布时间】:2021-10-13 17:29:16
【问题描述】:
我有一个数据框,其中有一列包含各种单词。我还有一个单独的字符串列表(与 df 的长度不同),我想在数据框中创建一个新列,将字符串与列中的单词匹配,但只保留字符串的一部分直到那个词。
例如: 我有这张桌子:
| words | |
|---|---|
| apple | |
| plant | |
| banana | |
| animal | |
| fly | |
| ecoli |
还有这些字串:
stringlist <- c("eukaryote;plant;apple", "eukaryote;plant;banana","eukaryote;animal;dog", "eukaryote;plant;orange" "eukaryote;animal;cat"; "eukaryote;insect;fly", "prokaryote;bacterium;ecoli")
我想得到这个:
| words | new_words |
|---|---|
| apple | eukaryote;plant;apple |
| plant | eukaryote;plant |
| banana | eukaryote;plant;banana |
| animal | eukaryote;animal |
| fly | eukaryote;insect;fly |
| ecoli | prokaryote;bacterium;ecoli |
我尝试过类似的方法:
df$words <- c("apple", "plant", "banana", "animal", "fly", "ecoli")
df$new_words<- sub(df$words, "", stringlist)
【问题讨论】:
标签: r