【发布时间】:2019-10-01 19:06:24
【问题描述】:
我的文档如下所示:
<ul>
<li>
<a href="/Synergies">Link</a>Content
</li>
</li>
Content <a href="/Synergies">Link</a>
</li>
</ul>
我只想获取以<a> 标记开头的列表项,即第一个<li> 会成功,但第二个不会。
我尝试在 html 内容上获取所有列表项和正则表达式匹配,但它似乎不起作用:
list.search('li').each do |item|
if /^<a href="\/Synergies".*$/.match(item)
puts link # hit?
end
end
任何建议将不胜感激!
【问题讨论】:
标签: ruby html-parsing nokogiri