【发布时间】:2014-03-20 10:34:00
【问题描述】:
我正在使用HtmlAgiityPack。
它是解析数据的绝佳工具,但是我使用它的每个实例,我总是有一个类或 id 来瞄准,即 -
string example = doc.DocumentNode.SelectSingleNode("//div[@class='target']").InnerText.Trim();
但是,我遇到了一段文本,它没有嵌套在任何具有我可以瞄准的类或 id 的特定模式中。例如。 -
<p>Example Header</p>: This is the text I want!<br>
但是,给出的示例始终遵循相同的模式,即文本始终位于 </p>: 之后和 <br> 之前。
我可以使用正则表达式来提取文本,但我更喜欢使用敏捷包,因为其余代码也将遵循。有没有办法使用包做到这一点?
【问题讨论】:
标签: c# regex parsing html-agility-pack