【发布时间】:2018-10-16 14:18:39
【问题描述】:
<font color="white">
<b>Name:</b> USERNAME [585743] <br>
<b>Money:</b> $MONEY <br>
<b>Location:</b> CITY<br>
<b>Level:</b> 43<br>
<b>Gold:</b> 4706 / 5315<br>
</font>
我在一个杂乱的页面中有这个 HTML。我想提取每个</b> 和<br> 之间的元素。它们是纯文本,没有我可以使用的有用的类或 ID。
到目前为止我使用过的代码:
browser.open(bank_url)
soup = browser.parsed
result2 = re.search(r'</b> (.*?)<br/>', src).group(0)
print(result2)
这导致了
</b> USERNAME [585743] <br>
正在打印。这是一个好的开始,但由于某种原因,我无法打印更多元素?
有没有办法只提取一段特定的文本?例如金色文字 4706 / 5315 ?
我在 python 3.6 中使用 robobrowser,beautifulsoup
【问题讨论】:
标签: python-3.x beautifulsoup robobrowser