【发布时间】:2014-04-12 17:09:56
【问题描述】:
我如何筛选 scrape 由 javascript 生成的 html 页面? 我试过这样的事情:
HtmlAgilityPack.HtmlDocument doc = new HtmlAgilityPack.HtmlDocument();
HtmlWeb hw = new HtmlWeb();
doc = hw.Load("http://stats.nba.com/scores.html?gameDate=04/11/2014");
HtmlNodeCollection nodes = doc.DocumentNode.SelectNodes("//div[@id='scoreboards']");
但这不起作用,因为内容是由 javascript 生成的。 javascript生成html后有没有办法抓取页面? 也许使用敏捷包以外的东西?
【问题讨论】:
-
如果您想废弃由 javascript 创建的 html,请使用 webbrowser 控件
-
@GujjuDeveloper 你能给我一个例子或链接我吗?:)
标签: c# screen-scraping html-agility-pack