【发布时间】:2015-01-05 00:53:13
【问题描述】:
我有点了解如何使用XML 包来读取和解析XML 文件,例如RSS 提要的一部分。但是,连续阅读 RSS 提要的基本设置是什么?
例如,假设我想建立一个设施,从http://evemaps.dotlan.net/feed/sovereignty 连续读取提要并将数据存储在某种 R 数据结构中(例如,data.frame)。我想我需要执行以下操作:
- 在服务器上设置 R(例如 AWS 实例上的 RStudio Server)
- 打开到 rss 源的 HTTP 连接
- 不断读取和解析提要的不同位,并将它们添加到
data.frame,该data.frame会随着添加的每个条目而增长
不过,这还是一张比较模糊的图片。我需要将哪些基本包和功能串在一起才能完成这项工作?含义:创建这样一个设施需要采取哪些基本步骤?我不是在寻找任何人为我编写这个工具(即使那会很好!)。相反,我试图了解所涉及的总体步骤。
【问题讨论】: