【发布时间】:2015-01-10 17:14:02
【问题描述】:
我陷入了一个似乎无法解决的顽固问题。
我试图仅在某个特定字符位于 html 标记内(而不是介于两者之间)时才找到它。
为了测试这个,我有 2 个测试字符串:
- 没有 HTML 的字符串。这是第 2 句。
- 带有 一些 HTML 的字符串。
this is <a href="www.somesite.com">sentence</a>
我想在 html 标记中查找所有句点字符,因此匹配应该是 www.somesite.com 中的 2 个句点,我无法正确匹配。有人可以看看我的正则表达式,看看我缺少什么吗?
(<[^>]*>?(\.))>?
【问题讨论】:
-
使用 dom 解析器并检查元素属性,不要使用正则表达式解析 HTML。
-
这看起来不像是格式正确的正则表达式模式,您使用的是什么函数?
-
即使你匹配了一个html标签中的句点,你还能从中得到什么信息?也许它不止一个时期。鉴于此,您必须分两步执行此操作。首先,捕获标签的内容(包含需要找到的内容),然后分别解析内容。
-
试试
<([^>]*\.[^>]*)>,然后在.上分1美元