【发布时间】:2022-01-18 20:58:14
【问题描述】:
我正在尝试阅读显示https://stockanalysis.com/stocks/ 市值详细信息的表格
下面的代码只读取前 500 个观察值,因为它正在读取的网站在第一页上只显示 500 个。
需要帮助确定我需要使用哪些 HTML 元素才能从所有页面中提取数据。感谢Vishal A,在这里我使用了“符号表”对象
library(rvest)
library(dplyr)
url <- ("https://stockanalysis.com/stocks/")
page <- read_html(url)
stocks <- page %>%
html_nodes('table#symbol-table') %>%
html_table() %>% .[[1]]
stocks
【问题讨论】:
标签: html r web-scraping