【发布时间】:2018-06-04 10:58:59
【问题描述】:
当谷歌浏览器通过 Selenium 加载网页时,它可能会加载页面所需的其他文件,例如来自<img src="example.com/a.png"> 或<script src="example.com/a.js"> 标签。此外,CSS 文件。
如何获取浏览器加载页面时下载的所有 URL 的列表? (以编程方式,在 Python 中使用 Selenium 和 chromedriver) 也就是Chrome中开发者工具的“网络”标签中显示的文件列表(即显示下载文件的列表)。
使用 Selenium、chromedriver 的示例代码:
from selenium import webdriver
options = webdriver.ChromeOptions()
options.binary_location = "/usr/bin/x-www-browser"
driver = webdriver.Chrome("./chromedriver", chrome_options=options)
# Load some page
driver.get("https://example.com")
# Now, how do I see a list of downloaded URLs that took place when loading the page above?
【问题讨论】:
-
你有什么尝试吗?显示您的代码
-
@Andersson 我并没有真正尝试过获取下载的 URL 列表。但我刚刚编辑了这个问题,将我的 Selenium 设置包含在 Python 中。除了这个,我不知道我还能做什么。
-
@vatsug BrowserMob 代理解决方案不能解决这个问题吗?
-
@GPT14 我现在去看看,回来报告,谢谢你的回复。
标签: python selenium selenium-webdriver selenium-chromedriver