【发布时间】:2022-01-26 18:32:41
【问题描述】:
我正在尝试使用 selenium 从网站下载 excel 文件。我不确定为什么代码不允许我下载它。我得到一个退出代码 0,所以一切都运行成功,但我没有在我的下载中看到该文件。
from selenium import webdriver
from selenium.webdriver.chrome.service import Service
from webdriver_manager.chrome import ChromeDriverManager
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.common.by import By
from selenium.webdriver.support import expected_conditions as EC
def scrape_mclellan_website():
url = 'https://www.mcoscillator.com/market_breadth_data/'
s = Service(ChromeDriverManager().install())
op = webdriver.ChromeOptions()
op.add_argument('headless')
driver = webdriver.Chrome(service=s)
driver.get(url)
download_link = driver.find_element(by=By.XPATH, value='//*[@id="data_table"]/a[1]/img')
download_link.click()
scrape_mclellan_website()
【问题讨论】:
-
您是否尝试过在正常(非无头)模式下运行它并观察会发生什么?
-
是的 - 行为是一样的
-
您是否尝试单击锚点而不是 img?
value='//*[@id="data_table"]/a[1]'- 没有无头模式。 -
QHarr 都嵌入了链接。很好的收获
标签: python selenium web-scraping