【发布时间】:2012-05-18 19:09:33
【问题描述】:
我有以下代码来解析 html 表。如何检查 <td> 元素中的指定文本?这不起作用:val=doc.xpath('//tr/td[child::*[text()="Street :"]/span/text()')。仅当<td> 文本与“街道:”匹配时,我才尝试提取<span> 文本。非常感谢任何反馈!
import lxml.html as lh
html='''<tr>
<td>
Street : <span> High St. </span>
</td>
</tr>
<tr>
<td>
City : <span> Hightstown </span>
</td>
</tr>'''
doc=lh.fromstring(html)
#val=doc.xpath('//tr/td[child::*[text()="Street :"]/span/text()')
#street=doc.xpath('//tr/td/text()')
val=doc.xpath('//tr/td/span/text()')
#print street
print val
【问题讨论】: