【发布时间】:2020-09-08 02:09:20
【问题描述】:
我的代码:
mug_cup_link = '.....'
mc_source = urlopen(mug_cup_link).read()
name=findall('<a href="" >".*"</a>',mc_source)
我正在搜索多个名称,而不仅仅是一个。
【问题讨论】:
-
提示:不要使用正则表达式来解析 HTML。改用一些解析器。见Parsing HTML Using Python。
-
但我的评估必须使用 regex 。我无法改变它。而且我不知道如何找到项目名称
-
您应该使用捕获组。见here。
-
另外,regex101 可能对您有用。
-
谢谢:D 真的很有用