【发布时间】:2014-11-07 20:50:35
【问题描述】:
我有一系列的表达方式如:
"<i>the text I need to extract</i></b></a></div>"
我需要提取<i> 和</i>“符号”之间的文本。也就是说,结果应该是:
"the text I need to extract"
目前我在 R 中使用 gsub 手动删除所有非文本符号。但是,我想使用正则表达式来完成这项工作。有谁知道提取<i> 和</i> 之间的正则表达式吗?
谢谢。
【问题讨论】: