【问题标题】:select xpath of data in a tag using lxml使用 lxml 在标签中选择数据的 xpath
【发布时间】:2012-02-08 04:58:21
【问题描述】:

我正在尝试在下面的标签中选择“(6)”:

<a class="itemRating" href="http://www.newegg.com/Product/ProductReview.aspx?Item=N82E16834200347" title="Rating + 4">
<span class="eggs r4">&nbsp;</span>
(6)
</a>

xpath,我称之为review,在下面的()中:

review = site.xpath('/html/body/div[3]/div[2]/table/tr/td[2]/div/div[8]/div/div/div/a[3]

当我尝试打印review[0].text 时,它会打印'None' 而不是(6)

有什么想法吗?

【问题讨论】:

    标签: python xpath screen-scraping lxml


    【解决方案1】:

    (6)&lt;span&gt; 元素的尾部:

    >>> a[0].tail
    '\n(6)\n'
    

    【讨论】:

      【解决方案2】:

      你可以使用:

      review[0].text_content().strip()
      

      review[0].xpath('string()').strip()
      

      我会把你的 xpath 写成:

      review = site.xpath('//a[@class="itemRating"]')
      

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 2011-09-25
        • 2010-10-17
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 2014-06-22
        • 1970-01-01
        相关资源
        最近更新 更多