【发布时间】:2020-04-25 10:10:56
【问题描述】:
我正在尝试使用具有多个页面的 python 抓取一个论坛。
示例:https://www.f150forum.com/f118/would-you-buy-f150-again-463954/
如何去网站的多个页面提取每个用户的cmets?提前谢谢你
url = "https://www.f150forum.com/f118/would-you-buy-f150-again-463954/"
page = requests.get(url, headers=headers)
soup = BeautifulSoup(page.text, 'html.parser')
domains = soup.find_all("div")
posts = soup.find(id = "posts")
comments_class = soup.findAll('div',attrs={"class":"ism-true"})
comments = [row.get_text() for row in comments_class]
【问题讨论】:
-
查看这个库:scrapy.org
标签: python web-scraping beautifulsoup