【发布时间】:2018-10-04 09:28:55
【问题描述】:
我正在使用命令行运行多个爬虫,这是一个自动化过程。
Python:2.7.12
Scrapy:1.4.0
操作系统:Ubuntu 16.04.4 LTS
我想知道scrapy是如何处理这种情况的
- 没有足够的内存/cpu 带宽来启动爬虫。
- scraper 运行期间内存/cpu 带宽不足。
我浏览了文档,但找不到任何东西。
任何回答此问题的人,您都不必知道正确答案,如果您能指出您知道的任何资源的大致方向,这将不胜感激
【问题讨论】:
-
我们在这里讨论了多少个爬虫/网站?
-
发生在我身上,如果服务器上没有足够的资源,Scrapy 进程就会被杀死
-
在任何情况下大约有 32 个刮板
标签: python python-2.7 memory-management scrapy