【发布时间】:2020-11-13 15:08:03
【问题描述】:
我正在尝试提取一个 html 表格并将其转换为 R 中的 data.frame 或 data.table。
我要提取包含比特币历史数据的表格:
https://coinmarketcap.com/currencies/ethereum/historical-data/?start=20170101&end=20201113
(完整的 Xpath:/html/body/div/div[1]/div[2]/div[1]/div[2]/div[3]/div/ul[2]/li[5]/div/div/div[2]/div[3]/div/table)
这是我迄今为止尝试过的:
library(magrittr)
library(rvest)
URL <- "https://coinmarketcap.com/currencies/bitcoin/historical-data/?start=20170101&end=20201113"
PRICES <- read_html(URL) %>% html_nodes("table")
我的猜测是表格是在页面的其余部分加载之后加载的。
理想情况下,我希望提取方法与其他加密货币历史表一起使用,例如:
https://coinmarketcap.com/currencies/ethereum/historical-data/?start=20170101&end=20201113
【问题讨论】:
标签: r web-scraping rvest