【发布时间】:2020-04-02 16:43:46
【问题描述】:
我正在尝试创建一个 scraper,它可以进入网站并下载包含房地产基金资产负债表的 XML 文件。
使用下面的代码,我输入文档编号为 07000400000146(在 URL 末尾)的特定基金的网站,使用网站上的搜索栏过滤文档,然后单击以下载表格中的第一个文档XPath。
driver.get('https://fnet.bmfbovespa.com.br/fnet/publico/abrirGerenciadorDocumentosCVM?cnpjFundo=07000400000146')
driver.find_element_by_css_selector(f'input[type="search"]').click()
driver.find_element_by_css_selector(f'input[type="search"]').send_keys('informe mensal')
time.sleep(1)
driver.find_element_by_xpath('//*[@id="tblDocumentosEnviados"]/tbody/tr[1]/td[10]/div/a[2]/i').click()
我如何创建一个布尔表达式来发现行是 03/2020 或 02/2020 还是 01/2020,在“参考数据”列中,然后下载每个相应日期的所有可用文件?
【问题讨论】:
标签: python python-3.x selenium xpath selenium-chromedriver