【问题标题】:How to download uri data:text file using R?如何使用 R 下载 uri 数据:文本文件?
【发布时间】:2021-05-20 22:36:24
【问题描述】:

我正在尝试使用 R 下载我认为所谓的 URI 数据:文本文件。“URL”的格式如下:

URL

后面还有数百个字符。当我在网络浏览器中输入“URL”并按下回车键时,所需的 CSV 文件会毫无问题地下载。但是,当我尝试在上述字符串上使用类似 download.file 或 curl_download 的内容时,会出现如下错误:

curl_download(URL, destfile = "test1234.csv") 中的错误: 端口号以“t”结尾

关于如何使用 R 下载 csv 数据的任何见解:像这样的文件?谢谢!

如果有任何用处,我正在尝试下载的文件粘贴在下面。我必须先将字符串保存为 .txt 文件,然后使用 read_file 导入该 .txt 文件,以便将其作为字符串存储在 R 中。

【问题讨论】:

    标签: r web-scraping uri


    【解决方案1】:

    数据 URL 并不是真正的普通 URL,它包含文本内的所有数据,而不是指向不同位置的数据。它由两部分组成:“标题”和数据本身。标头由“data:text/csv;charset=utf8”组成,然后是数据,但它是 HTML(或 URL)编码的。您可以通过删除标题、解码值,然后使用read.csv 将文本作为 CSV 文件读取来读取数据。例如:'

    read.csv(text=URLdecode(gsub("^data:text/csv;charset=utf8,","", URL)), 
       check.names = FALSE)
    

    【讨论】:

    • 非常感谢!像魅力一样工作!
    猜你喜欢
    • 1970-01-01
    • 2011-12-17
    • 2015-01-01
    • 1970-01-01
    • 2019-05-19
    • 2016-11-20
    • 1970-01-01
    • 2021-12-19
    • 2020-01-09
    相关资源
    最近更新 更多