【发布时间】:2019-03-09 12:08:18
【问题描述】:
我正在尝试使用此网站https://www.timeanddate.com/weather/ 通过以下方式打开 URL 来使用 BeautifulSoup4 抓取天气数据:
quote_page=r"https://www.timeanddate.com/weather/%s/%s/ext" %(country, place)
我还是网络抓取方法的新手,BS4,我可以在页面的来源中找到我需要的信息(例如,我们在这个搜索中将国家作为印度,城市作为孟买)链接为: https://www.timeanddate.com/weather/india/mumbai/ext
如果您看到页面的来源,使用CTRL+F 并找到“湿度”、“露点”和当前天气状态(如果晴天、下雨等)等信息的属性并不难。 ),唯一阻止我获取这些数据的是我对BS4 的了解。
您能否检查页面源并编写BS4 方法来获取诸如
“感觉像:”、“能见度”、“露点”、“湿度”、“风”和“预报”?
注意:在我必须获取 HTML 标记中的值(如 <tag class="someclass">value</tag>)之前,我已经完成了数据抓取练习
使用
`
a=BeautifulSoup.find(tag, attrs={'class':'someclass'})
a=a.text.strip()`
【问题讨论】:
-
如果你需要天气数据,为什么不直接使用像openweathermap.org/api这样的API?
-
这是一个很棒的 API,感谢您的评论。是的,我绝对可以使用更简单的 API,但这个问题的主要动机是了解我如何使用 beautifulsoup 来解决现实生活中的问题,而不仅仅是阅读文档和查看示例。但是,您提供的链接很有用。
标签: python web-scraping beautifulsoup