【发布时间】:2016-03-10 10:04:27
【问题描述】:
我正在使用 Scrapyd 将 scrapy 用作 web 服务。
我想使用带有如下参数的 curl 命令:
curl http://myip:6800/schedule.json -d project=default -d spider=myspider -d domain=www.google.fr
但是我不知道如何在爬虫中获取参数域。
import scrapy
from scrapy.spiders import CrawlSpider, Rule
from scrapy.linkextractors import LinkExtractor
class MyItem(Item):
url = Field()
class HttpbinSpider(CrawlSpider):
name = "expired"
start_urls = [domain]
有时我需要在参数中传递一个域或多个域。
谢谢!
【问题讨论】:
标签: python web-scraping scrapy scrapyd