【问题标题】:Scraping profile urls on LinkedIn using selenium使用 selenium 在 LinkedIn 上抓取个人资料网址
【发布时间】:2020-08-28 20:38:34
【问题描述】:

我有一个包含候选人姓名的 CSV 文件,我想提取他们的 LinkedIn 个人资料 URL。我已经使用 selenium 自动登录并从 CSV 获取名称输入并单击搜索按钮,但无法访问页面上的个人资料 URL。例如:我想在以下 Linkedin 页面上抓取个人资料 URL,但是当我查询以下内容时它没有返回任何内容:

链接:https://www.linkedin.com/search/results/all/?keywords=April%20Siose&origin=GLOBAL_SEARCH_HEADER

driver.find_element_by_class_name("search-result__result-link ember-view").get_attribute("href")

【问题讨论】:

    标签: python selenium web-scraping web-crawler href


    【解决方案1】:
    linkedin_urls = [url.get_attribute("href") for url in linkedin_urls]
    

    这是 selenium 中用于提取 LinkedIn 个人资料 URL 的命令。

    【讨论】:

      【解决方案2】:

      该网站似乎要求您在显示所需页面之前登录。 driver 库可能具有身份验证功能或类似于自动登录的功能

      【讨论】:

      • 所以,我使用 selenium 自动化了登录部分,但在这个阶段遇到了问题。
      • 我发现了一个有用的post 它应该仍然可以工作。如果没有,LinkedIn 可能再次更改了结构,您可能需要修改参数
      • 我用一个新链接编辑了我的评论,因为上面的帖子现在已经过时了。道歉
      • 你能建议一种不使用请求的方法吗?它会增加我想避免的超时并发症。
      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2021-04-11
      • 2018-01-27
      • 1970-01-01
      • 1970-01-01
      • 2017-12-28
      • 2018-11-09
      相关资源
      最近更新 更多