【发布时间】:2020-04-17 08:24:41
【问题描述】:
我有一个包含单词和数字的字符串。
[1] "\r\nfund \r\ncompany \r\nfee \r\nsales \r\ngroup \r\npayment \r\nmanagement \r\nfirm \r\nfee \r\ntotal \r\npayment \r\nsubtotal \r\nfee \r\nsynthetic \r\nfee... sth ... \r\n0.646 0.030 0.030 0.015 1.253....
如你所见,有一种模式有 sth~ fee, sth~ payment。 我的最终目标是使用扫描功能或其他方法将单词分组以制作此表(如果您有任何想法,请回复。)
所以我尝试删除所有空白,因为扫描功能(我猜)以一些空白作为标准来划分单词组。
我的意思是,我想让这个字符串像这样
[1] "\r\nfundcompanyfee \r\nsalesgrouppayment \r\nmanagementfirmfee \r\ntotalpayment \r\nsubtotalfee \r\nsyntheticfee... sth ... \r\n0.646 0.030 0.030 0.015 1.253....
我尝试过像这样使用 gsub 函数
gsub("\r\n\\w\\w.*?fee|payment","\\w\\w",strings)
但结果很糟糕。它使字符串像这样
ww ww ww ww........ 0.646 0.030 0.030 ....
那是它不将 \w 识别为单词.. 只需将其翻译为 'w' 就可以了!
所以我需要一些帮助来处理这个问题。 感谢您的阅读。
【问题讨论】: