【发布时间】:2018-02-19 01:39:06
【问题描述】:
我正在努力让自己熟悉 requests 和 BeautifulSoup,所以我给了自己一个小项目。我正在尝试制作一个在Footlocker的发布日历上显示鞋子的程序 (https://www.footlocker.com/release-dates/) 像这样:
- 鞋名#1 日期#1
- 鞋名#2 日期#2
- 鞋名#3 日期#3
- 鞋名#4 日期#4
到目前为止,我有这个:
import requests as req
from bs4 import BeautifulSoup
def main():
url = "https://www.footlocker.com/release-dates/"
resp = req.get(url)
soup = BeautifulSoup(resp.content, "html.parser")
print(soup)
但是,当我加载 HTML 以使用 BeautifulSoup 解析时,包含鞋子日期和名称信息的 HTML 代码不会像我直接在网站上使用检查元素时那样显示。我认为这是因为带有鞋子信息的 HTML 是由 Javascript 生成的。如果是这样,我该如何加载它的请求?
谢谢。
【问题讨论】:
-
学习和使用
Selenium。
标签: python html web-scraping beautifulsoup python-requests