【发布时间】:2016-03-26 22:07:04
【问题描述】:
关于 Python 和 Selenium 抓取网页表格数据的大多数问题都涉及带有 ID 或类的表格,以及一些使用行数和列数的索引技术。 Xpath 技术通常也不解释。
假设我有一个没有元素 ID 或类的表,我们以 this one 为例。
我想返回值“Johnson”,而不计算行号或列号。
这是我的尝试(已编辑)...
import selenium.webdriver as webdriver
import contextlib
url = 'http://www.w3schools.com/html/html_tables.asp'
with contextlib.closing(webdriver.Firefox()) as driver:
driver.get(url)
columnref = 3
rowref = 4
xpathstr = '//tr[position()=' + str(rowref) + ']//td[position()=' + str(columnref) + ']'
data = driver.find_element_by_xpath(xpathstr).text
print data
我已经在这里得到了一些很好的帮助,但我仍在使用索引。我需要通过查找它们的值来生成“columnref”和“rowref”。分别是“姓氏”和“3”。
【问题讨论】:
-
这不是
xpath的正确形式。为您的表格提供html部分代码 -
@Andersson - 干杯我更新了问题:)
-
@drets 这不是很好。好吧,我没有标记它,希望这个人这样做。与此同时,我正在为自己解决剩下的问题,而不是抱怨有人只为我完成了 75% 的工作。
-
问题已被投票;-)
标签: python-2.7 selenium xpath