【发布时间】:2021-07-13 06:59:38
【问题描述】:
我正在尝试使用 Python 从网站中提取材料列表的名称和价格。我正在使用下面的代码:
from bs4 import BeautifulSoup
import requests
urls = ['https://www.bricomart.es/materiales-de-construccion/elementos-de-construccion/ladrillos-y-bloques/']
for url in urls:
headers = {'User-Agent': 'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_10_1) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/39.0.2171.95 Safari/537.36'}
response = requests.get(url, headers=headers)
soup = BeautifulSoup(response.content, 'html.parser')
for response in soup.find_all('div', class_='products-list-product'):
Price = response.p.text
print(Price)
我正在使用标头,因为如果没有标头,它会给我一个 403 错误。现在我没有收到错误(状态码是 200),但仍然无法获得我需要的信息。运行此代码时我什么也得不到。
有人可以帮忙吗?我更愿意坚持使用 Beautifulsoup 和 requests,因为我对编码的理解非常有限。
谢谢
【问题讨论】:
标签: python web-scraping beautifulsoup python-requests