【发布时间】:2015-07-20 12:51:28
【问题描述】:
我想用 python 中的 lxml 解析来自 Nasa 网站的以下 html:
<p>
<strong>Launch Date:</strong>1981-09-24<br/>
<strong>Launch Vehicle:</strong> Delta<br/>
<strong>Launch Site:</strong> Cape Canaveral, United States<br/>
<strong>Mass:</strong> 550.0 kg<br/>
</p>
使用python3的以下代码:
from lxml.html import parse
page = parse("http://nssdc.gsfc.nasa.gov/nmc/spacecraftDisplay.do?id=1981-096A")
rows = page.xpath('//div[@class="urtwo"]/p')[0]
for element in rows:
print(element.xpath("string()"))
但是heads后面的值是空的……:
Launch Date:
Launch Vehicle:
Launch Site:
Mass:
我认为这与或有关。
谁能帮我找到解决办法?
【问题讨论】:
标签: python html html-parsing lxml lxml.html