【问题标题】:Scrapy Amazon absolute path but with no value returnedScrapy Amazon 绝对路径但没有返回值
【发布时间】:2023-03-16 07:54:01
【问题描述】:

我正在尝试通过使用如下绝对路径来使用来自 amazon.co.uk 的 Scrapy 一些信息。但奇怪的是没有返回值。我对 Scrapy 很陌生:

scrapy shell http://www.amazon.co.uk/product-reviews/B0042EU3A2/

response.xpath('//*[@id="productReviews"]/tbody/tr/td[1]/a[1]/@name').extract()

我希望它在这种情况下返回名称属性是:RI4HGFJCSI04W

【问题讨论】:

    标签: xpath web-scraping scrapy amazon scrapy-shell


    【解决方案1】:

    只需从表达式中省略tbody

    In [1]: response.xpath('//*[@id="productReviews"]//tr/td[1]/a[1]/@name').extract()
    Out[1]: [u'RI4HGFJCSI04W']
    

    【讨论】:

    • 谢谢!但是为什么“tbody”会惹麻烦呢?
    • @W.S.问题是该页面的 HTML 源代码中不存在 tbody 元素。您可能在浏览器 DOM 中看到了它,但那是因为浏览器会自动为所有表创建一个 tbody 元素。
    猜你喜欢
    • 1970-01-01
    • 2010-09-05
    • 1970-01-01
    • 2015-10-16
    • 2021-05-23
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-10-26
    相关资源
    最近更新 更多