【问题标题】:Python lxml xpath not workingPython lxml xpath不起作用
【发布时间】:2015-12-26 18:56:21
【问题描述】:

下面是一个打印链接中教授姓名的简单程序:http://cse.iitkgp.ac.in/index.php?secret=d2RkOUgybWlNZzJwQXdLc28wNzh6UT09

xpath 查询//font[1]/b/a/b/text() 在单独测试时给出输出名称。然而,这个程序给出了一个空列表作为输出。有什么想法我在这里做错了吗?

import sys
import requests
import lxml.html

def getdata():
    v = lxml.html.document_fromstring(requests.get("http://cse.iitkgp.ac.in/index.php?secret=d2RkOUgybWlNZzJwQXdLc28wNzh6UT09").content)
    profs = v.xpath('//font[1]/b/a/b/text()')
    for prof in profs:
        print prof

if __name__=="__main__":
    getdata()

【问题讨论】:

    标签: python xpath lxml


    【解决方案1】:

    该页面使用 AJAX 进行渲染,即:您需要的元素列表通过 JavaScript 加载。

    这是实际提供数据的 URL:

    http://cse.iitkgp.ac.in/faculty4.php?_=1451158710268

    我通过使用 Chromium 中的开发人员工具查找 XHR 请求找到了它。

    【讨论】:

    • 像魅力一样工作..谢谢!你是怎么想出这个网址的?
    猜你喜欢
    • 1970-01-01
    • 2016-03-06
    • 1970-01-01
    • 2017-03-21
    • 2011-07-17
    • 1970-01-01
    • 1970-01-01
    • 2018-09-30
    • 2017-03-06
    相关资源
    最近更新 更多