【发布时间】:2023-03-10 05:30:01
【问题描述】:
我在使用正则表达式时遇到问题。
所以基本上我有这种字符串:
string = '<bash><exit><bash-trap><terminology>'
我最后想要的是所有单独单词的列表: ['bash', 'exit', 'bash-trap', '术语']
到目前为止我做了什么:
substitution = re.sub(r'[^A-Za-z0-9-]+', ' ', string)
然后
re.split(r'[^A-Za-z0-9-])',substitution)
这给了我以下结果:
['', 'bash', 'exit', 'bash-trap', 'terminology', '']
谢谢!
【问题讨论】:
-
print(re.findall(r"\<(.*?)\>", string))? -
你的正则表达式还不错。您可以在您的第一个
re.sub之后简单地调用substitution.split()。 -
或者在
split前加一个strip。