【发布时间】:2012-01-14 06:05:06
【问题描述】:
我正在 asp.net 中创建一个网站,但我遇到了一些问题..
我编写了一个程序,它可以抓取给定的网页,即 thenextweb.com 的链接、内容和图像。
现在我想将这些爬取的数据存储在我的表 *Crawlr_Data* 中。
我希望爬虫每 30 分钟运行一次,并使用新链接更新表格(如果有)。
{在我网站的主页上,我正在显示存储在数据库中的信息}
如何在后端运行爬虫并更新数据库? 我应该使用什么技术(Web 服务、WCF)或 Visual Studio 中我可以使用的任何其他东西,以便我如果在线托管网站,它的爬虫继续运行和更新表格}
请建议 谢谢
【问题讨论】:
标签: c# asp.net database wcf web-crawler