【发布时间】:2016-01-09 12:38:08
【问题描述】:
我知道这是一个愚蠢的问题,但我就是找不到问题。无法使用 xpath 从 html 文档中的正文节点获取内部文本。
我正在使用的代码:
HtmlWeb web = new HtmlWeb();
HtmlDocument doc = web.Load(String.Format(url, companyName));
HtmlNode node = doc.DocumentNode.SelectSingleNode("//body");
string code = null;
try
{
code = node.FirstChild.InnerText;
}
catch (NullReferenceException e)
{
}
网站结构:
<html>
<body>PYRIX | preston york</body>
</html>
【问题讨论】:
-
node.InnerText应该这样做。 -
不。它不会,因为其中包含文本的任何节点实际上都在元素内的文本节点内。所以,firstChild 在这里我们将文本节点
-
string text = doc.DocumentNode.SelectSingleNode("//body").InnerText;对我来说这行得通...