【发布时间】:2022-08-18 20:12:23
【问题描述】:
这是我的做法,但我不确定它是否为每个新请求创建和使用新上下文:
class TestSpider(scrapy.Spider):
name = \'test\'
start_urls = [...]
cnt = 0
def start_requests(self):
for url in self.start_urls:
yield scrapy.Request(url=url,
meta={\'playwright\': True,
\'playwright_context\': f\'{self.cnt}\'})
def parse(self, response):
self.cnt += 1
for res in response.xpath(\'//div[@id=\"contenu\"]\'):
url = res.xpath(\'.//h2/a/@href\').get()
yield scrapy.Request(url=url,
callback=self.get_content,
meta={\'playwright\': True,
\'playwright_context\': f\'{self.cnt}\'})
这段代码是在做我想做的事情还是错了?
标签: python scrapy playwright-python