【发布时间】:2018-12-20 19:06:45
【问题描述】:
我正在解析一个 XML 文件,需要从最终输出中删除一些混乱。
str = <?xml version="1.0" encoding="UTF-8" standalone="yes"?><chat-message>2018-10
我的解决方案是:
re.sub(r'<(\w|\d|\s){1,}>{1,4}',"",str)
我想要的输出是:
2018-10
目前 Python 没有找到匹配项,只返回 str。我不认为< 或> 是特殊字符,因此不需要转义;无论如何我都尝试逃跑,但它仍然不起作用。
【问题讨论】:
-
您能否再举一些例子,很难推断出您想要精确匹配的内容。现在可能像 re.sub(r'.*>(?! 而不是紧跟一个