【发布时间】:2016-01-22 22:32:56
【问题描述】:
我想从site 下载每日照片,但我不能使用 JPEG 的 URL,因为它每天都在变化。
有没有办法使用页面 URL 和 XPath 从站点下载对象?我试图在 WebClient 中找到一些方法,但没有运气。
【问题讨论】:
-
尝试下载 html 文件,隔离
primary_photo类,然后从那里隔离img标签。然后就可以得到src直接下载了。 -
可以使用 HTMLAgilityPack(你可以从 nuget 获得)
-
是的,我同意@Nasreddine。 HTMLAgility 在这里应该做得很好。图片 url 似乎在唯一的
<link rel="canonical"元素中。使用 XPath 应该很容易做到这一点。
标签: c# xpath html-parsing webclient-download