【发布时间】:2013-03-12 12:31:55
【问题描述】:
我正在尝试在 BB 和 </p> 两个模式之间提取一个子字符串:
require("stringr")
str = "<notes>\n <p>AA:</p>\n <p>BB: word, otherword</p>\n <p>Number:</p>\n <p>Level: 1</p>\n"
str_extract(str, "BB.*?:</p>")
提取的子串应该是“word, otherword”,但是我抓的太多了:
[1] "BB: word, otherword</p>\n <p>Number:</p>"
【问题讨论】:
-
.*是贪婪的。它将一直捕获到最后一次出现</p> -
@Arun 实际上,
.*是贪婪的,但.*?不是。我认为这是一个错位的冒号,但问题仍然没有完全解决。 -
哎呀,看
?,你是对的。