【发布时间】:2015-10-22 15:35:39
【问题描述】:
我有一个包含n 行的文本文件,每一行都是一个字符串。
我想将其导入 R 并使用正则表达式依次删除(特别是)以http 开头的所有 URL。
以下内容在交互式正则表达式检查器(Emacs 中的重新构建器)中有效,但在 R 中无效。
gsub("http:.*?[([:space:])| |\n]", "", x))
注意
这个问题和我在下面给出的答案源于this question 关于正则表达式引擎及其相互兼容性。
【问题讨论】: