【发布时间】:2014-12-17 07:56:43
【问题描述】:
我有一些类似于 JSON 文件的字符串:
string <- "{'text': u'@RobertTekieli @Czerniakowianka @1234Mania mysle, ze nie weszlabym do zadnego wiezienia bez straznikow', 'created_at': u'Tue May 20 08:16:55 +0000 2014'}"
我想提取两个字符串——在text和created_at之后
@RobertTekieli @Czerniakowianka @1234Mania mysle, ze nie weszlabym do zadnego wiezienia bez straznikow
和
Tue May 20 08:16:55 +0000 2014
我想用正则表达式而不是fromJSON 函数或类似的东西来做。但实际上我不知道怎么做。有什么建议吗?
【问题讨论】:
-
用正则表达式解析 JSON 字符串可能非常痛苦。你不想使用内置函数的原因是什么?
-
这仍然不是有效的 JSON 数据。你真的应该尝试获得有效的输入。从长远来看,它会让您的生活更轻松。
-
我知道,这就是为什么我想把它当作普通字符串。
stri_extract_all_regex(wiadomosc, "\\{'text': u'.*")给了我整个文本,我怎么能用正则表达式语言“说”我想在“created_at”之前结束?它也会令人满意。