【发布时间】:2020-11-27 14:27:59
【问题描述】:
#我想提取评分为 4 或 5 的评论 cmets 的描述和评分。尝试了多个选项,最新如下:有人可以帮忙
import requests
from bs4 import BeautifulSoup
from scrapy.http import HtmlResponse
response = HtmlResponse(url='https://www.bankbazaar.com/credit-card.html')
url ='https://www.bankbazaar.com/credit-card.html'
r = requests.get(url)
soup = BeautifulSoup(r.content, 'html5lib')
quotes=[] # a list to store quotes
table = soup.find('div', attrs = {'class':'reviewbox-container'})
for row in table.findAll('li', attrs = {'class':'review-box'}):
quote = {}
quote['rating'] = row.find('input', name_ = 'review.reviewRating.customer.0')
quote['descr'] = row.find('div',class_ = 'text_here review-desc-more')
print(quotes.append(quote))
【问题讨论】:
-
更新了描述,这会正确检索描述但无法检索评级然后提取所选数据:-----quote['descr'] = row.find('div', attrs={"class":"text_here review-desc-more"}).string
标签: python web-scraping beautifulsoup