【发布时间】:2011-08-17 15:31:42
【问题描述】:
我正在尝试使用正则表达式从以下 html 中提取文本“abcdef”:
<a href="xyz.com" rel="bookmark" title="hello_world">abc def</a>
我正在尝试这种模式
$pattern = "<a href=(.*?) rel='bookmark' title=(.*?)>(.*?)</a>"
如果有人帮助我找出模式,那将会很有帮助。我正在使用 PHP 。
谢谢
【问题讨论】:
-
如果这就是你的 html,
strip_tags就可以了。如果没有,DOMDocument是你的朋友。最好避免使用正则表达式来解析 XML 或 HTML。
标签: php regex html-parsing