【问题标题】:Extract Pronouns from text in R从R中的文本中提取代词
【发布时间】:2016-07-18 12:53:26
【问题描述】:
sample_text <- ' Ramesh is my frien. He is a very good man' 

现在我需要从我的文本中提取所有代词(PRPPRP$

acqTag <- tagPOS(sample_text)

我得到以下内容

$POStagged 
 [1] "Ramesh/NNP is/VBZ my/PRP$ frien/NN ./. He/PRP is/VBZ a/DT very/RB good/JJ man/NN"
$POStags
 [1] "NNP"  "VBZ"  "PRP$" "NN"   "."    "PRP"  "VBZ"  "DT"   "RB"   "JJ"   "NN"  

现在我如何从这里获得代词? PRP or PRP$

【问题讨论】:

  • 类似stringr::str_extract_all(acqTag$POStagged,"[[:alpha:]]/PRP")。来自...的tagPOS 是什么包?
  • @BenBolker 我也在想同样的事情。我想这就是stackoverflow.com/questions/28764056/…
  • @BenBolker 抱歉,您提到的上述语法没有给我想要的输出。看来需要重新检查了!谢谢!
  • 注意我说的是“类似”。我作为评论发布,因为我认为它可能有用,但没有时间测试......
  • 当然!我只是提到它不起作用。无论如何谢谢!

标签: r tm


【解决方案1】:

你想要输出什么?这似乎给出了我认为你想要的:

library("stringr")

prp <- str_extract_all(acqTag$POStagged,"\\w+/PRP\\$?")
str_replace(unlist(prp), "/PRP\\$?", "")
#[1] "my" "He"

【讨论】:

  • 最好使用一个正则表达式而不是两个"(\\w+)(?=/PRP)"
猜你喜欢
  • 2014-12-30
  • 1970-01-01
  • 2010-12-25
  • 1970-01-01
  • 2014-06-10
  • 2016-06-29
  • 2019-05-06
相关资源
最近更新 更多