【发布时间】:2015-12-28 21:45:45
【问题描述】:
我需要获取“relay.albacom.net”和“smtp.albacom.net”
import re
string="""<tr bgcolor="#d3ebf8"><td>Albacom</td><td>relay.albacom.net</td><td></td></tr><tr bgcolor="#d3ebf8"><td>Albacom</td><td>smtp.albacom.net</td><td></td></tr>"""
test=re.findall(r'<tr bgcolor="#d3ebf8"><td>.*</td><td>(.*)</td><td>.*</td></tr>', string)
print test
但是,我只收到['smtp.albacom.net']。
下面的.* 表示任何字符对吗?所以它应该工作......
谢谢!
【问题讨论】:
-
输出正确,看here。关键是第一个
.*将匹配整个字符串,然后该模式在捕获组之后只需要1 TD。因此,您将获得最后一个单元格的内容。