【发布时间】:2012-10-04 17:13:00
【问题描述】:
我有一段 html 代码,如下所示:
<td width="24%"><b>Something</b></td>
<td width="1%"></td>
<td width="46%" align="center">
<p><b>
needed
value</b></p>
</td>
<td width="28%" align="center">
</td>
</tr>
提取单词Something之后的第一个文本节点(不是标签,而是里面的文本)的一个好的正则表达式模式是什么我的意思是我想提取
needed
value
仅此而已。
我无法在 php 中找出有效的正则表达式模式。
编辑: 我不是在解析整个 html 文档,而是其中的几行,所以我只想使用 Regex 而不是 HTML 解析器来完成它。
【问题讨论】:
-
不要使用正则表达式解析 HTML。 See this post 为什么。
-
请不要使用 RegEx 解析 HTML,因为它会 drive you į̷̷͚̤̤̖̱̦͍͗̒̈̅̄̎n̨͖͓̹͍͎͔͈̝̲͐ͪ͛̃̄͛ṣ̷̵̞̦ͤ̅̉̋ͪ͑͛ͥ͜a̷̘͖̮͔͎͛̇̏̒͆̆͘n͇͔̤̼͙̩͖̭ͤ͋̉͌͟eͥ͒͆ͧͨ̽͞҉̹͍̳̻͢。请改用HTML parser。
-
感谢您的回答。我知道正则表达式不是正确的方法,但我唯一要解析的是“需要的值”,所以我认为使用 Html 解析器完成这项任务是过大的。