【发布时间】:2018-06-02 12:53:42
【问题描述】:
我尝试使用以下站点学习 response.xpath 和 response.css:http://quotes.toscrape.com/
scrapy shell 'http://quotes.toscrape.com'
for quote in response.css("div.quote"):
title = quote.css("span.text::text").extract()
这只会得到一个值。 但如果我使用 xpath:
scrapy shell 'http://quotes.toscrape.com'
for quote in response.css("div.quote"):
title = quote.xpath('//*[@class="text"]/text()').extract()
它将获得整个页面上所有标题的列表。
有人能告诉我使用这两种工具有什么不同吗?有些元素我比较喜欢用response.xpath,比如具体的表格内容,follow-sibling很容易拿到,但是response.css就拿不到
【问题讨论】: