【发布时间】:2020-12-18 09:14:50
【问题描述】:
我正在使用 scrapy python 创建一个数据抓取工具。我使用此命令获取类别,但它只显示一个类别
链接:https://royalprint.pk/product/name-print-superhero-sweatshirt-011/
In [6]: response.css('span.posted_in a::text').get()
Out[6]: 'Name Print Sweatshirt'
这是控制台预览
我想要在单独的 excel .csv 列中的所有主类别和子类别
请帮忙。
问候
【问题讨论】:
-
请将整个代码贴出来(以便于重现)
-
我之前没用过scrapy,只有漂亮的汤。你试过用 getall() 代替 get() 吗?
-
先生,我已经发布了shell代码
-
@HjSin,通过使用 getall 我得到这个 In [7]: response.css('span.posted_in a::text').getall() Out[7]: ['Name Print Sweatshirt ', '运动衫'] 但是是否可以先获得产品主类别,然后再获得子类别?因为 woocommerce 有 Main Category > Sub category > Sub Sub Category
-
只是一些提示:考虑将您的 css 选择器转换为 xpath,因为scrapy 会自动执行此操作,这样做时您将获得性能 + 可以灵活地上下遍历(关键字:兄弟姐妹、祖先、后代)。在这里您可以找到有关 Xpath 的帮助:css-selector-to-xpath.appspot.com
标签: python python-3.x web-scraping scrapy