【发布时间】:2019-12-14 10:24:30
【问题描述】:
我希望能够点击搜索结果页面上的多个链接。为此,我尝试创建一个 Web 元素列表,以查找与链接对应的搜索结果页面上的所有 xpath。然后我希望能够单击每个 xpath 的这些链接并返回到搜索结果页面并单击列表中的下一个链接。
到目前为止,我已经能够创建一个嵌套循环,该循环会抓取页面上的所有 href 标记以创建/查找 xpath。第二级循环旨在点击列表中该元素对应的链接,然后返回搜索页面点击列表中的下一个元素。
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from bs4 import BeautifulSoup
import requests
driver = webdriver.Chrome('C:\\Users\\km13\\chromedriver.exe')
driver.get("http://www.congreso.gob.pe/pley-2016-2021")
WebDriverWait(driver, 50).until(EC.frame_to_be_available_and_switch_to_it((By.NAME, 'ventana02')))
soup = BeautifulSoup(driver.page_source, 'lxml')
table = soup.find('table', {'cellpadding' : '2'})
table_items = table.find_all('a')
for item in table_items:
elements = driver.find_elements_by_xpath("//a[@href='" + item.get('href') + "']")
print(elements)
for elem in elements:
elem.click()
driver.back()
此代码将单击搜索结果页面上的第一个链接,转到该链接,然后单击返回搜索结果页面。但它不会迭代到元素列表中的下一个链接。不知道是不是我写的循环有问题?
【问题讨论】:
-
是的。当您导航回搜索结果时,这些元素将变得陈旧并且不再起作用。您将不得不再次找到这些元素。
-
阅读ericlippert.com/2014/03/05/how-to-debug-small-programs,了解如何调试代码的技巧。