【发布时间】:2021-11-27 14:43:09
【问题描述】:
我要请求这个网址:
https://www.codal.ir/CompanyList.aspx
这个url包含110个页面的表格,当页面改变时,url和新请求都没有改变。
这是我的代码:
import requests as req
req = req.Session()
isics = req.get("https://www.codal.ir/CompanyList.aspx")
print(isics.text)
但我只获得第一页信息。我打算通过请求和正则表达式从表格中提取所需信息,但如果您有其他方式,我会很高兴听到。感谢您帮助我获得整个页面。
【问题讨论】:
-
我会准备一个答案,但我必须知道你是否可以使用
Selenium。我将使用它来自动在页面之间导航。 -
是的,我可以使用。我一直在寻找一种更快地使用请求库的方法,但如果你也解决了 selenium 的问题,我会很高兴。
标签: python api selenium beautifulsoup request