【发布时间】:2020-09-12 17:32:11
【问题描述】:
我正在尝试在此网站上抓取数据 :https://scrapingclub.com/exercise/detail_cookie/ 但数据存储在 这个网址:https://scrapingclub.com/exercise/ajaxdetail_cookie/?token=YQ00FY4B4D
每次访问时令牌都会更改
我不知道如何从第二个 url 中提取数据
import json
class FindgoldSpider(scrapy.Spider):
name = 'findgold'
def start_requests(self):
url='https://scrapingclub.com/exercise/ajaxdetail_cookie/?token='
headers = {
'User-Agent': 'Mozilla/5.0',
'X-Requested-With' : 'XMLHttpRequest' ,
}
cookies = {
'__cfduid' : 'd6ec4f3842fa1b47ec88a035af6773fd11599773899' ,
}
yield scrapy.http.Request(url, headers=headers)
def parse(self, response):
data = response.json
print(data)
【问题讨论】:
标签: python python-3.x web-scraping scrapy