【问题标题】:Package "rvest" for web scraping https site with proxy用于使用代理抓取 https 站点的“rvest”包
【发布时间】:2016-07-02 18:36:25
【问题描述】:

我想废弃一个 https 网站,但失败了。

这是我的代码:

require(rvest)
url <- "https://www.sunnyplayer.com/de/"
content <- read_html(url)

但我在控制台中有错误-“open.connection(x, "rb") 中的错误:已达到超时” 我该如何解决这个问题?

【问题讨论】:

  • 该代码为我运行而没有错误。该问题可能与您的代理有关。
  • R 中的代理需要什么设置?请帮帮我。
  • 我只知道它在没有代理的情况下对我有用。您的标题提到您正在使用代理,所以如果这是您的设置和我的设置之间的唯一区别,那么这一定是问题所在。
  • 请使用代理 rvest 编写示例代码

标签: r web-scraping rvest


【解决方案1】:

同样的事情发生在我的代理身上。要解决此问题,请使用 download.file 并指定下载位置。然后,您可以使用 read_html 解析文件。

download.file(url, destfile = 'C://whatever.html')
content <- read_html('C://whatever.html')

【讨论】:

    猜你喜欢
    • 2017-03-22
    • 1970-01-01
    • 1970-01-01
    • 2021-02-04
    • 2018-10-13
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-08-15
    相关资源
    最近更新 更多