【发布时间】:2013-07-24 17:56:51
【问题描述】:
我正在尝试从该页面上的特定元素中抓取文本数据(使用 scraperwiki)
import requests
from lxml import html
response = requests.get(http://portlandmaps.com/detail.cfm?action=Assessor&propertyid=R246274)
tree = html.fromstring(response.content)
owner = tree.xpath('/html/body/div[2]/table[1]/tbody/tr[11]/td[2]')
print owner.text
scraperwiki 控制台返回:
AttributeError: 'list' object has no attribute 'text'
我使用 Google Chrome 查找 XPath,但我认为 requests 使用与 chrome 相同的标准
【问题讨论】:
-
问题本身就是为什么 owner 是一个列表。尝试打印出所有者而不是 owner.text 并在此处报告
-
另外,您可能需要检查响应内容是什么。
-
response 给了我一个普通的 HTML 文档,XPath 把 owner 变成一个列表,这样正常吗? 'print len(owner)' 返回 0
标签: python lxml scraper scraperwiki