【发布时间】:2013-07-03 10:19:21
【问题描述】:
我正在尝试制作一个脚本来帮助我从网站上获取新书。
我正在使用 preg_match_all。我有 7 个信息要获取:标题、作者、编辑...
我在创建我的预匹配掩码时遇到了一些问题。例如,我需要这里的产品代码。每个页面上有 3 到 10 个代码产品。 :
<li><label>Réf : </label>21608</li>
起初我正在尝试这个:
$mask ="/Réf :(.*)<\/li>/Us";
这是可行的,但我只想要数字。我正在网上搜索正则表达式指南,但我不明白如何将语法用于我的目标,因为此代码产品没有介于两个这样的标签之间:<open>...</open>。此代码产品有 4 或 5 个数字。
感谢您的帮助!
【问题讨论】:
-
如果您尝试解析 XML/HTML,最好使用实际的解析器,而不是尝试使用正则表达式。
标签: regex