【发布时间】:2022-01-06 13:53:21
【问题描述】:
import requests
from bs4 import BeautifulSoup
url = "https://check-for-flooding.service.gov.uk/station/8208"
r = requests.get(url)
soup = BeautifulSoup(r.content, "lxml")
for each_div in soup.findAll('strong',{'class':'defra-flood-statistics__impact'}):
print each_div
我似乎尝试了所有方法,包括各种 nth-of-type 变体,但我不断收到'NoneType' object has no attribute 'text'。
我对目前大约 1m 左右的河流水位感兴趣,但由于某种原因我无法自行选择它。
...
<dd class="defra-flood-statistics__value">
<strong class="defra-flood-statistics__impact defra-flood-statistics__impact--normal">
Normal
</strong>
0.05m to 1.90m <span class="govuk-visually-hidden">level here</span>
</dd>
...
<dd class="defra-flood-statistics__value">
<strong class="defra-flood-statistics__impact">
1.00m
</strong>
at <time datetime="">2:30pm</time> today
</dd>
...
【问题讨论】:
-
你使用“lxml”而不是“html.parser”有什么原因吗?
-
不,没有理由!谢谢你的建议
标签: python beautifulsoup python-requests