【发布时间】:2013-05-15 13:56:51
【问题描述】:
我正在尝试在 HTTP 响应正文中搜索这样的短语:
>> myvar1
<HTML>
<HEAD> <TITLE>TestExample [Date]</TITLE></HEAD>
</HTML>
当我这样做时,我没有得到任何结果:
>> myvar.scan(/<HEAD> <TITLE>TestExample [Date]<\/TITLE><\/HEAD>/)
[]
这里,[Date] 是一个动态变量,通过循环迭代获取其值。
我应该在正则表达式中添加/更改什么?
我正在使用 Nokogiri 扫描 HTTP 响应正文中的关键字。
【问题讨论】:
-
不要使用正则表达式解析 HTML。您无法使用正则表达式可靠地解析 HTML,并且您将面临悲伤和挫败感。一旦 HTML 与您的期望发生变化,您的代码就会被破坏。请参阅下面的 nokogiri 回复。
-
@Andy Lester Thnx 提醒大家。
标签: ruby regex html-parsing