【问题标题】:Cannot find text by xpath (scrapy)无法通过 xpath 找到文本(scrapy)
【发布时间】:2016-10-12 03:27:20
【问题描述】:

我尝试使用 xpath 从下面列出的示例中获取日期。

<node>
    <table>
        <td>
            <font style="font-size:14px">http://www.aaa.com</font>

             &nbsp;&nbsp;2016-10-11 17:14:11

        </td>
    </table>
</node>

我使用的代码如下:

response.xpath('/node/table/td/text()[2]').extract()

但是它不起作用。我希望它会返回 u'[  2016-10-11 17:14:11],但它会返回 []。谁能帮帮我?

【问题讨论】:

    标签: python html xpath scrapy


    【解决方案1】:

    你可以试试xpath

    response.xpath('/node/table/td/font/following-sibling::text()[1]').extract()
    

    【讨论】:

    • 感谢您的帮助。我试过你提供的方法。描述 ('/node/table/td/font/following-sibling::text()[1]') 适用于 Chrome 的开发者工具。但是,它仍然无法在我的 scrapy 程序中运行。
    • 你检查过原始的HTML源代码吗?通常,Web 浏览器会更改文档以修复损坏的或非标准的 HTML。所以在你浏览器的开发工具中工作的东西可能与scrapy(和下面的lxml)解释的不同。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-11-19
    • 2021-01-13
    • 1970-01-01
    相关资源
    最近更新 更多