【发布时间】:2012-02-20 08:36:10
【问题描述】:
我正在尝试下载一个包含这样的表格的页面
<table id="content-table">
<tbody>
<tr>
<th id="name">Name</th>
<th id="link">link</th>
</tr>
<tr class="tt_row">
<td class="ttr_name">
<a title="name_of_the_movie" href="#"><b>name_of_the_movie</b></a>
<br>
<span class="pre">message</span>
</td>
<td class="td_dl">
<a href="download_link"><img alt="Download" src="#"></a>
</td>
</tr>
<tr class="tt_row"> .... </tr>
<tr class="tt_row"> .... </tr>
</tbody>
</table>
我想从 td class="ttr_name" 中提取 name_of_the_movie 并从 td class="td_dl" 下载链接
这是我用来循环遍历表格行的代码
HtmlAgilityPack.HtmlDocument hDocument = new HtmlAgilityPack.HtmlDocument();
hDocument.LoadHtml(htmlSource);
HtmlNode table = hDocument.DocumentNode.SelectSingleNode("//table");
foreach (var row in table.SelectNodes("//tr"))
{
HtmlNode nameNode = row.SelectSingleNode("td[0]");
HtmlNode linkNode = row.SelectSingleNode("td[1]");
}
目前我不知道如何检查 nameNode 和 linkNode 并提取其中的数据
任何帮助将不胜感激
问候
【问题讨论】:
标签: c# .net html-agility-pack