【发布时间】:2017-12-25 07:11:22
【问题描述】:
我正在尝试抓取一些数据,我想我找到了解决方案,但我正在努力为其编写代码。
# This returns a list that changes depending on the page
description = response.xpath('.//*[@class="txtGrey size14-description"]/text()').extract()
我需要获取准确的 len(description) 并将该长度添加为描述的索引(不确定我是否正确使用了单词 index)
例如
description = response.xpath('.//*[@class="txtGrey size14-description"]/text()').extract()
len(description)
如果描述长度为 4
代码需要说的
description = response.xpath('.//*[@class="txtGrey size14-description"]/text()').extract()[-4:]
注意:我需要 '-' 和 ':' 。
我将浏览几页,所以 len 总是在变化。我假设我需要为此编写一个新函数。 任何帮助将不胜感激。
【问题讨论】:
-
请给出描述示例和该描述的所需输出,因为不清楚您将如何使用 len
-
无论 len 是什么,我都会用它来索引描述。我遇到了一个障碍,当我将抓取的数据输出为 csv 时,“描述”单元格始终为空。虽然当我使用 [-1:] 作为索引时,那些在描述中只有 1 个列表的会出现,其余的不会出现。我希望通过使用确切的 len,我能够使所有描述正常工作。
-
仍然没有例子不清楚你真正想要达到的目标。
标签: python web-scraping scrapy