【发布时间】:2021-08-31 21:32:17
【问题描述】:
我试图在亚马逊上刮下这个产品的价格,但是当我使用 bs4 的 find 功能时,我得到一个无对象,谁能告诉我我的代码有什么问题:
from bs4 import BeautifulSoup
import smtplib
import requests
Url="https://www.amazon.fr/HyperX-Cloud-Sans-fil-interrupteur/dp/B08NTYB4M7/ref=sr_1_2?__mk_fr_FR=%C3%85M%C3%85%C5%BD%C3%95%C3%91&crid=3O51QACXTGCAX&dchild=1&keywords=hyperx+cloud+2+wireless&qid=1630444291&sprefix=hyperx+cloud+2+w%2Caps%2C203&sr=8-2"
page=requests.get(Url)
soup=BeautifulSoup(page.content, "html.parser")
print(soup.find(id="productTitle"))
【问题讨论】:
-
亚马逊通常会阻止 Web scappers。尝试打印
page.text。你可能需要一个代理服务器来解决这个问题。 -
你要刮价格还是产品标题?
-
我知道 id 的价格是错误的,但是当我输入正确的 id 时,我仍然得到一个无对象
标签: python web-scraping beautifulsoup python-requests