【发布时间】:2014-08-24 20:26:45
【问题描述】:
我对此很陌生,并且一直在尝试了解我的第一个选择器。有人可以帮助我吗?我正在尝试从此页面中提取数据:
div class= Listing clearfix ShelfListing 下的所有信息,但我似乎无法弄清楚如何格式化 response.xpath()。
我已经成功启动了scrapy 控制台,但是无论我在response.xpath() 中输入什么,我似乎都无法选择正确的节点。我知道它有效,因为当我输入时
>>>response.xpath('//div[@class="container"]')
我收到了回复。然而,我不知道如何导航到清单 cleardix 货架清单。我希望一旦我得到这一点,我就可以继续通过蜘蛛工作。
PS 我想知道是否无法扫描此站点 - 所有者可以阻止蜘蛛吗?
【问题讨论】:
标签: python xpath web-scraping scrapy scrapy-spider