【发布时间】:2019-08-26 03:08:39
【问题描述】:
我有这个 HTML:
"This is simple html <a href='google.com'>text</a><span class='simple'>simple simple text text</span> text"
我只需要匹配 HTML 标记之外的单词。我的意思是如果我想匹配“简单”和“文本”,我应该只从 HTML 标签内部获取结果,除了标签。
我很接近这个正则表达式(text|simple)(?![^<]*>|[^<>]*<\/),但我排除了所有的html标签。
【问题讨论】:
-
通常可以使用正则表达式,但greatly discouraged。请解释为什么你需要用正则表达式来做。添加有关编程语言的详细信息。
-
一种编程语言是Java。我正在替换从服务器收到的 HTML 请求中的内容,我需要替换一些出现的单词,但我需要忽略已经存在的链接。
-
...我可以给你介绍一下这个stackoverflow.com/questions/1732348/…