【发布时间】:2014-06-14 12:46:04
【问题描述】:
我一直在玩 Rapidminer,但似乎不太明白这一点。我在一个 excel 文件中列出了一个巨大的 URL 列表,并且想从每个 URL 中提取一个 XPath 元素。无论如何我可以用 Rapidminer 做到这一点吗?
我看过 Neil Mcguigan 的教程,但它们似乎是从总体上抓取网站/站点,而不是从一组特定的 URL。
【问题讨论】:
-
看起来与here 的问题非常相似。
标签: xpath web-scraping web-crawler rapidminer