【发布时间】:2020-09-25 20:40:32
【问题描述】:
class Me2Spider(scrapy.Spider):
name = 'me'
allowed_domains = ['www.amazon.com']
start_urls = [
'https://www.amazon.com/dp/B08DL5SQDM?th=1',
'https://www.amazon.com/dp/B08DL6D52S?th=1',
'https://www.amazon.com/dp/B01LW14DG7?th=1'
]
def parse(self, response):
yield{
'ASIN': response.xpath('//div[@class="a-section table-padding"]/table[@id="productDetails_detailBullets_sections1"]/tbody/tr[1]/td').get(),
'Ranking': response.xpath('//*[@id="prodDetails"]/div/div[2]/div[2]/div/div[1]/span[3]/text()').get(),
}
我以前也这样刮过,现在数据出不来了。
【问题讨论】:
-
请清楚说明您面临的问题。如果有错误,请在问题中发布错误。这将为我们提供详细信息,以更好地帮助您
-
没有错误。但是当我运行程序时,ASIN 和排名数据并没有被抓取。我想知道为什么NULL来了?
标签: python web-scraping scrapy amazon