【发布时间】:2013-05-02 01:03:57
【问题描述】:
一切都在标题中!
有没有办法为 python 使用的 selenium-chromedriver 定义下载目录?
尽管进行了很多研究,但我还没有找到结论性的东西... 作为一个新手,我已经看到了很多关于 Chromedriver 的“the desired_capabilities”或“the options”的东西,但没有解决我的问题......(我仍然不知道它是否会!)
再解释一下我的问题: 我有很多要扫描的网址(200 000),每个网址都有一个要下载的文件。 我必须创建一个包含 url、我在上面废弃的信息以及我刚刚为每个网页下载的文件的名称的表格。 对于我必须处理的卷,我创建了打开多个 chromedriver 实例的线程以加快处理速度。 问题是每个下载的文件都到达同一个默认目录,我无法再将文件链接到 url... 因此,想法是为每个线程创建一个下载目录,以便逐个管理它们。
如果有人在标题中回答了我的问题,或者有一种解决方法来识别下载的文件并将其与当前 url 链接,我将不胜感激!
【问题讨论】:
-
一般情况下,我建议您不要使用 chrome 下载东西,这通常是一个经过深思熟虑的测试,只是将所有内容下载到静态文件夹中。你对下载的文件做任何事情吗?阅读以下内容:ardesco.lazerycode.com/index.php/2012/07/… 然后是 blog.pythonlibrary.org/2012/06/07/…
-
您好,感谢您的回复。我实际上不使用 Selenium 来运行测试,而是真正自动下载大量数据 csv 文件以进行后期处理。我曾尝试探索 urllib2 方式,但在网站上进行身份验证时遇到了困难......(可能是因为我是周日 DIY 新手,而当我找到 Selenium 时,它一直是金蛋鹅!.. .)
标签: python selenium selenium-chromedriver