【发布时间】:2013-06-29 14:29:56
【问题描述】:
我想获取不同域下的网页,这意味着我必须在命令“scrapy crawl myspider”下使用不同的蜘蛛。但是,由于网页的内容不同,我必须使用不同的管道逻辑将数据放入数据库。但是对于每个蜘蛛来说,它们都必须经过 settings.py 中定义的所有管道。是否有其他优雅的方法可以为每个蜘蛛使用单独的管道?
【问题讨论】:
-
Scrapy 本身并不将蜘蛛限制在单个域中。
标签: python web-scraping scrapy scrapy-spider