【问题标题】:Parsing Meta Tag using xPath使用 xPath 解析元标记
【发布时间】:2016-03-13 19:39:02
【问题描述】:

如何解析元标记,例如

<meta itemprop="email" content="email@example.com" class="">

..并从中提取电子邮件。

当我复制此标签的 xPath 时,我得到以下内容,这不起作用

//*[@id="businessDetailsPrimary"]/div[2]/div/meta

请指教。

非常感谢

【问题讨论】:

    标签: xpath xml-parsing web-scraping


    【解决方案1】:

    itemprop="email" 属性很可能在整个网页中是唯一的。在这种情况下,您可以通过XPath 访问content 属性来选择电子邮件,如下所示:

    //meta[@itemprop="email"]/@content
    

    Demo

    如果itemprop="email" 不是唯一的,您可以通过首先选择id 等于businessDetailsPrimary 的元素来使您的XPath 更具体:

    //*[@id="businessDetailsPrimary"]//meta[@itemprop="email"]/@content
    

    Demo

    【讨论】:

    猜你喜欢
    • 2016-10-02
    • 2016-02-20
    • 2011-12-29
    • 1970-01-01
    • 1970-01-01
    • 2012-07-17
    • 1970-01-01
    • 1970-01-01
    • 2014-07-06
    相关资源
    最近更新 更多