【发布时间】:2020-08-27 10:45:38
【问题描述】:
我在用 Beautiful soup/Selenium 给动态表加汤时遇到了麻烦
当我运行代码时,我无法在笔记本中获取整个 html 代码。
我感兴趣的标签在我应该以某种方式“打开”的标签“框架集”下。我怎么能这样做?
driver = webdriver.Chrome('/Users/Administrador/Documents/chromedriver')
main_url = 'https://www.justiciacordoba.gob.ar/Estatico/JEL/Escrutinios/ReportesEleccion20190512/default.html'
driver.get(main_url)
soup = BeautifulSoup(driver.page_source, 'lxml')
soup
output : <html><head></head><frameset border="0" cols="*" frameborder="NO" framespacing="0" id="fset" rows="190,*">
<frame name="topFrame" scrolling="NO" src="Index.html"/>
<frame align="center" name="mainFrame" src="about:blank"/>
</frameset><noframes></noframes>
</html>
【问题讨论】:
-
你有什么问题?
-
根据您打算如何处理数据,您可能甚至不需要 BeautifulSoup。
-
另外,我敢打赌,这只是笔记本中的输出被切断的情况。
标签: python selenium-webdriver web-scraping beautifulsoup