【发布时间】:2021-07-14 14:52:44
【问题描述】:
有一个字符串向量,如下所示(带有两个或多个引号的子字符串的文本):
vec <- 'ab"cd"efghi"j"kl"m"'
第一对引号 (cd) 中的文本包含一个有用的标识符(cd 是所需的输出)。我一直在研究如何使用正则表达式,但我还没有学会如何找到引号之类的第一次和第二次出现。
这是我获得 cd 的方式:
tmp <- strsplit(vec,split="")[[1]]
paste(tmp[(which(tmp=='\"')[1]+1):(which(tmp=='\"')[2]-1)],collapse="")
"cd"
我的问题是,还有其他方法可以使用正则表达式找到“cd”吗?为了了解更多如何使用它们。我更喜欢基本 R 解决方案,但如果这是唯一的方法,我会接受使用包的答案。感谢您的帮助。
【问题讨论】: