【发布时间】:2018-10-20 02:52:57
【问题描述】:
我有一个看起来像这样的网站,我想使用 firefox + selenium + python 提取 uid 字段的内容。每页只有 1 个 UID。
<div class= "parent" >
<div class="module profile" dcp="1" uid="90">
...
...
</div>
</div>
具体请看以下内容:
<div class= "parent" >
<div class="module profile" dcp="1" uid="[RETURN THIS]">
...
...
</div>
</div>
我在 selenium 中尝试了几种技术,包括使用
browser.find_elements_by_name
browser.find_elements_by_xpath
browser.find_elements_by_class_name
browser.find_elements_by_css_selector
但是它们都不能返回 UID。我要么得到一个空集,要么只得到类(即整个模块类而不是 DIV 内的属性)。
我看到一些人推荐了 get_attribute 选择器,但我没有成功地将它应用到这个用例中。
任何指导将不胜感激,谢谢。
【问题讨论】:
-
请提供您尝试过的 selenium 脚本..
-
整个脚本没有很多有用的信息。我相信我只需要一行选择器代码就可以得到这个。但是我尝试使用诸如
browser.find_elements_by_class_name("module")[0]之类的东西,但这会将整个返回到。还尝试了browser.find_elements_by_xpath("module.profile"),但这又返回了 div 的子级,而不是初始 div 块内的属性。谢谢
标签: python selenium xpath css-selectors getattribute