【发布时间】:2020-05-05 17:14:43
【问题描述】:
我正在尝试使用 Scrapy 框架抓取页面。
<div class="info"><span class="label">Establishment year</span> 2014</div>
我要处理的标签如上所示。我想获得 2014 年的值。我不能使用 info 或 label class,因为它们在页面中很常见。
所以,我在 xpath 下尝试了,但我得到了 null:
response.xpath("//span[contains(text(),'Establishment year')]/following-sibling").get()
response.xpath("//span[contains(text(),'Establishment year')]/following-sibling::text()").get()
任何线索可能是什么问题?
【问题讨论】:
标签: python web-scraping scrapy parsel