【发布时间】:2019-05-05 21:41:32
【问题描述】:
我正在尝试从该站点的表中提取值:https://www.geonames.org/search.html?q=&country=IT
在我的示例中,我想提取名称“Rome”并使用以下代码:
import requests
import lxml.html
html = requests.get('https://www.geonames.org/search.html?q=&country=IT')
doc = lxml.html.fromstring(html.content)
table_body = doc.xpath('//*[@id="search"]/table')[0]
cities = table_body.xpath('//*[@id="search"]/table/tbody/tr[3]/td[2]/a[1]/text()')
对我来说一切都很好,但是当我打印它时,结果是:
>>> print(cities)
[]
我真的不知道可能是什么问题,有人有什么建议吗?
【问题讨论】:
-
你到底要刮什么?
标签: python-3.x xpath python-requests lxml.html