【发布时间】:2020-08-14 15:11:30
【问题描述】:
我正在使用 python 和 selenium web 驱动程序从动态站点中抓取数据。
如何抓取嵌套锚标签内的元素的href?
<h3 class="">
<a href="some link/">Ultimate Content Writing</a>
</h3>
本站有很多上述类型的h3锚标签的链接,都是要刮掉的。我使用代码捕获了所有这些锚标记,
links = driver.find_elements_by_tag_name("h3")
然后我做到了,
for link in links:
href = driver.find_element_by_link_text(link.text).get_attribute('href')
其中包含不需要的操作并减慢我的程序。
如何更有效地获取每个链接的href?
【问题讨论】:
-
我不是专家,但有一个
find_elements_by_css_selector方法,因此您可以使用links = driver.find_elements_by_css_selector('h3>a')之类的方法来查找h3 标题中包含的所有链接。 -
你能分享一下你期望得到什么和当前输出的例子吗?
-
感谢@pawel,您的回复如此迅速。这帮我解决了。
标签: python selenium xpath css-selectors webdriverwait