【发布时间】:2009-04-27 10:11:04
【问题描述】:
我正在使用正则表达式解析一些 html,并且我想匹配以没有任何 html 标记的单词开头的行,同时还要删除空格。使用 c# regex 我的第一个模式是:
pattern = @"^\s*([^<])";
尝试抓取所有空白,然后捕获任何非“
有什么想法吗?
【问题讨论】:
-
HTML 解析已经讨论了很多。参考这个帖子:Using regular expressions to parse HTML: why not?
-
我可以向您推荐my answer 来回答另一个类似的问题吗?