【发布时间】:2016-12-16 13:40:47
【问题描述】:
这里有新成员。尝试从 R 中的网站下载大量文件(但也接受建议,例如 wget。)
来自this post,我知道我必须创建一个带有所需 URL 的向量。我最初的问题是写这个向量,因为我有 27 个州和每个州内的 34 个机构。我必须为所有州的每个机构下载一个文件。州代码始终为两个字符,而机构代码则为 2 到 7 个字符。 URL 如下所示:
http://website.gov/xx_yyyyyyy.zip
其中xx 是州代码,yyyyyyy 是机构代码,长度在 2 到 7 个字符之间。我不知道如何建立一个这样的循环。
我假设我可以使用以下功能下载此 url 列表:
for(i in 1:length(url)){
download.file(urls, destinations, mode="wb")}
这有意义吗?
(免责声明:此帖子的早期版本较早上传但不完整。我的错误,对不起!)
【问题讨论】:
-
这个简单的例子可能对
paste0(rep(letters[1:4], 4), rep(1:4, each=4))有帮助。如果没有更多关于机构名称的信息,就无法说得更多。 -
感谢您的意见。机构名称是首字母缩略词:FAA、DEA、NTSB 等。我用这些首字母缩写词创建了一个向量
agency,以及一个包含我需要的 27 个状态的states向量。将尝试您的建议并回复。 -
谢谢,@Imo!你的意见对我帮助很大。现在我了解了添加字符串变量的动态。
标签: r url web-scraping concatenation