【发布时间】:2020-06-20 09:09:09
【问题描述】:
This is the website I am scraping.
我在 Jupyter 中使用 BeautifulSoup,我想知道如何从这个网站上获取活动名称、位置和价格。我在 Inspect 工具中找到了它们的位置。
现在我找到了活动名称,但我觉得我的过程很长而且没有必要。
我的计划是将所有从该页面抓取的事件数据放入一个数据框中。
import pandas as pd
import requests
import bs4
from bs4 import BeautifulSoup
kpbs_link = "https://www.kpbs.org/events/search/?unifyevents=true&vertical_events=true&base_arts=true&base_category=137/"
page = requests.get(kpbs_link)
soup = BeautifulSoup(page.text)
events = soup.find_all('h4', {"class": "list_title"})
我觉得将它放入一个数组中并清洁它非常漫长而乏味,有没有更快的方法,以及如何。我使用美丽的汤从维基百科抓取数据,但他的网站更加乏味。
【问题讨论】:
标签: python pandas web-scraping beautifulsoup