【发布时间】:2014-05-13 12:54:04
【问题描述】:
假设我有一个 html 文档,例如:
<div id='findMe'>
<table>
<tr>
<td>
<p>
<a href="bad">bad</a>
</p>
</td>
</tr>
</table>
<p>
This is some text and this is a <a href="good">link</a>
</p>
</div>
我想捕获所有链接而不是 div #findMe,在段落标签内,而不是在表格或任何其他标签内。所以,我想要标有“好”的那个,而不是标有“坏”的那个。我正在尝试:
Nokogiri::HTML(html).css('#findMe p a')
但这会捕获两个链接。我还尝试了更明确的 xpath:
Nokogiri::HTML(html).css('#findMe').xpath('//p/a')
但这是做同样的事情。如何告诉 Nokogiri 只搜索树下的特定路径?
【问题讨论】: