【发布时间】:2019-11-25 06:13:57
【问题描述】:
我正在使用 rvest 包并试图弄清楚为什么有时它无法抓取绝对看起来像是表格的对象。
例如,考虑这样的脚本:
require(rvest)
url <- "http://bigcharts.marketwatch.com/quickchart/options.asp?symb=SPY"
population <- url %>%
xml2::read_html() %>%
html_nodes(xpath='//*[@id="options"]/table/tbody/tr/td/table[2]/tbody') %>%
html_table()
population
如果我检查population,它是一个空列表:
> population
list()
另一个例子:
require(rvest)
url <- "https://finance.yahoo.com/quote/SPY/options?straddle=false"
population <- url %>%
xml2::read_html() %>%
html_nodes(xpath='//*[@id="Col1-1-OptionContracts-Proxy"]/section/section[1]/div[2]') %>%
html_table()
population
【问题讨论】:
标签: r web-scraping rvest