【发布时间】:2016-08-27 16:34:46
【问题描述】:
我正在尝试构建一个应用程序来自动下载几个动漫剧集的过程,但我被卡住了。到目前为止,我已经能够使用以下代码找到剧集链接:
def get_episodes(driver):
WebDriverWait(driver, 10).until(EC.presence_of_element_located((By.XPATH, "//a[contains(@title,'Episode')]")))
episodes = driver.find_elements_by_xpath("//a[contains(@title,'Episode')]")
del episodes[-1]
episodes = list(reversed(episodes))
return episodes
但是最近我发现并不是每一集的链接文本中都包含“episode”这个词。因此,我正试图找出另一种方法来获取剧集的每个链接。页面的基本结构包含一个表格,每个链接都位于一个<td> 元素内。
我曾想过收集所有 td 元素,然后使用 css 选择器获取它们的子元素(或者我应该说是子元素)。然而,这也行不通,因为<td> 元素比那些看起来要多。
这里有一个example page 供参考。就硒而言,我是一个菜鸟,因此对它的 api 不是很熟悉,所以我不知道我在寻找什么。任何建议表示赞赏。
【问题讨论】:
标签: python selenium selenium-chromedriver