【发布时间】:2015-08-07 18:20:22
【问题描述】:
我是 selenium 的新手,我正在编写一个从给定站点自动下载 pdf 文件的刮板。
下面是我的代码:
from selenium import webdriver
fp = webdriver.FirefoxProfile()
fp.set_preference("browser.download.folderList",2);
fp.set_preference("browser.download.manager.showWhenStarting",False)
fp.set_preference("browser.download.dir", "/home/jill/Downloads/Dinamalar")
fp.set_preference("browser.helperApps.neverAsk.saveToDisk", "application/pdf")
browser = webdriver.Firefox(firefox_profile=fp)
browser.get("http://epaper.dinamalar.com/PUBLICATIONS/DM/MADHURAI/2015/05/26/PagePrint//26_05_2015_001_b2b69fda315301809dda359a6d3d9689.pdf");
webobj = browser.find_element_by_id("download").click();
我遵循了 Selenium documentation 和 this link 中提到的步骤。我不确定为什么每次都显示下载对话框。
有没有办法修复它,否则是否有办法提供“应用程序/全部”以便可以下载所有文件(解决方法)?
【问题讨论】:
标签: python selenium selenium-webdriver web-scraping web-crawler