【发布时间】:2017-02-20 09:13:18
【问题描述】:
我刚刚开始使用 python 进行网页抓取。我使用了两个库进行抓取:requests 和 beautiful soup。我打开给定的 URL,然后在该页面上传递我想要数据的日期间隔。当我按下提交时,URL 没有改变,但数据在页面上。然后我可以访问该页面。 这就是我访问网站的方式:
r = requests.get("https://....... ")
c = r.content
soup = BeautifulSoup(c, "html.parser")
如果我想获取数据,我使用以下代码从存储数据的网站获取数据:
all = soup.find_all("table", {"class":"table table-responsive table-data"})
我的 all 变量是一个空列表,而在网站上我可以看到数据在那里。
我知道为什么会出现这个问题。当我打开 URL 时,网站要求我提交一些参数,即我的情况下的日期,然后当我按下提交时,我得到数据但 URL 没有改变。
有什么方法我也可以使用请求或美丽的汤来提交参数吗? 或者任何其他包来解决这个问题?
【问题讨论】:
标签: python web-scraping beautifulsoup python-requests