【发布时间】:2021-02-15 07:30:38
【问题描述】:
我正在尝试构建一个正则表达式(在 python 中)以从文本文档中提取一个或两个值。要匹配的模式将始终采用以下形式:
<div>SCORE: x to y<\/div>
其中 x 和 y 可以介于 -7 和 + 6 之间。有时只会出现一个数字。如果有两个数字,我需要同时捕获这两个数字。此外,“to”可能缺少逗号或破折号,甚至“too”!空白是可变的。所以我需要类似的东西,
x,y=re.findall('<div>SCORE: (-+?[0-5])[a-zA-Z]?(-+?[0-5]?)<\/div>', text)
除了这显然是不正确的。任何指导表示赞赏。
示例包括
<div>SCORE: 0</div>
<div>SCORE: 0 to 5</div>
<div>SCORE: -1 to 6</div>
<div>SCORE: -1 to -3</div>
<div>SCORE: -4</div>
<div>SCORE: 3</div>
【问题讨论】:
标签: python python-3.x regex