【问题标题】:regex: matching phrases without a > or white space正则表达式:匹配没有 > 或空格的短语
【发布时间】:2009-04-27 10:11:04
【问题描述】:

我正在使用正则表达式解析一些 html,并且我想匹配以没有任何 html 标记的单词开头的行,同时还要删除空格。使用 c# regex 我的第一个模式是:

pattern = @"^\s*([^<])";

尝试抓取所有空白,然后捕获任何非“

有什么想法吗?

【问题讨论】:

标签: c# html regex


【解决方案1】:

不要使用正则表达式来解析 HTML。这是一个非常糟糕的主意,充其量,您的代码将是不稳定的。无论您的语言/平台是什么,您都将拥有一个功能齐全的 HTML 解析器。就用那个吧。

正则表达式无法正确处理转义、实体使用等所有情况。

【讨论】:

    【解决方案2】:

    很快就问了这个问题,刚刚解决了这个问题:

    模式 = @"^\s*((?!\s)[^

    感谢您对 regex 和 html 的反馈,我会记住它以备将来使用。我正在编写一个实用程序来制作几页多语言(即:为硬编码文本添加 asp:literals 等),我认为正则表达式足以达到此目的,但如果有更好的工具,请告诉我(网络的东西是不是我的地区...)。

    【讨论】:

      猜你喜欢
      • 2020-08-28
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-06-28
      • 1970-01-01
      • 2017-04-05
      相关资源
      最近更新 更多