【问题标题】:How to subset a vector of sentences containing a given word如何对包含给定单词的句子向量进行子集化
【发布时间】:2012-12-30 04:52:51
【问题描述】:

假设我有一个句子向量:

Vector
Juan is searching for a magazine.
Julia searched her car.
Go to the market to buy eggs.
Your name is unsearchable.
Search for me when you get to Paris.
Can you search for a low cost solution?

我想要这个向量的一个子集,它只包含带有“搜索”一词或其变体(即已搜索、不可搜索、搜索)的条目。在 excel 中,我可能会使用 ISNUMBER(SEARCH("search",A1)) 之类的东西来找出 A1 列中包含单词“search”的单元格。

在我看来grep 可能是我正在寻找的功能,但我不知道如何正确使用它。

【问题讨论】:

  • 你需要 value=TRUE grep 参数。 grep('search', Vector, value=TRUE)

标签: regex string r subset


【解决方案1】:

如果vector 是您指定的vertor:

> grep("search", vector, ignore.case=TRUE)
[1] 1 2 4 5 6
> vector[grep("search", vector, ignore.case=TRUE)]
[1] "Juan is searching for a magazine."      
[2] "Julia searched her car."                
[3] "Your name is unsearchable."             
[4] "Search for me when you get to Paris."   
[5] "Can you search for a low cost solution?"

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多