【问题标题】:WebScrape - Pagination/Next pageWeb Scraper - 分页/下一页
【发布时间】:2022-02-07 13:32:16
【问题描述】:

当前的代码可以正常工作并按照我想要的方式抓取页面。

但是,我怎样才能让它在下一页运行?第二个页面的 URL 不是唯一的,我想为所有页面运行。

import requests
from bs4 import BeautifulSoup as bs
lists=[]

r = requests.get('https://journals.lww.com/ccmjournal/toc/2022/01001')
soup = bs(r.content, 'lxml')
d = {i.text.strip():i['href'] for i in soup.select('.ej-toc-subheader + div h4 > a')}
lists.append(d)

【问题讨论】:

    标签: selenium web-scraping beautifulsoup pagination css-selectors


    【解决方案1】:

    这是一个动态加载的网页,您需要为此使用 selenium。看看这里:Selenium with Python

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2018-04-25
      • 1970-01-01
      • 2018-12-10
      • 1970-01-01
      • 1970-01-01
      • 2016-03-31
      • 1970-01-01
      相关资源
      最近更新 更多