【发布时间】:2019-06-15 12:32:31
【问题描述】:
我正在尝试从电子商务网页练习网页抓取。我已将容器(包含每个产品的单元格)的类名标识为'c3e8SH'。然后,我使用以下代码抓取该网页中的所有容器。之后,我使用len(containers)查看网页中的容器数量。
但是,它返回了 0。有人可以指出我做错了什么吗?非常感谢!
import bs4
from urllib.request import urlopen as uReq
from bs4 import BeautifulSoup as soup
my_url = 'https://www.lazada.sg/catalog/?spm=a2o42.home.search.1.488d46b5mJGzEu&q=switch%20games&_keyori=ss&from=search_history&sugg=switch%20games_0_1'
# opening up connection, grabbing the page
uClient = uReq(my_url)
page_html = uClient.read()
uClient.close()
#html parsing
page_soup = soup(page_html, 'html.parser')
#grabs each product
containers = page_soup.find_all('div', class_='c3e8SH')
len(containers)
【问题讨论】:
-
你确定类名是'c3e8SH'吗?我尝试用正则表达式解决你的问题,但我找不到任何名称为“c3e8SH”的类。
-
@hamedbaziyad 我添加了一张照片,我引用错了吗?
-
请确定你在图片中的部分。
标签: python web-scraping beautifulsoup urlopen