【发布时间】:2017-08-16 18:32:59
【问题描述】:
我正在尝试提取页面上的表格
使用 html_table 和 rvest,但是第一个文本,第一行是表格的一部分,显然会导致与 html_table 发生冲突。我留下代码
#Library's
library(rvest)
library(XML)
url<-"http://www.svs.cl/institucional/mercados/consulta.php?mercado=V&Estado=VI&entidad=RVEMI" #page
url<-read_html(url)
table<-html_nodes(url,"table") #read notes
table<-html_table(table,fill=TRUE) #write like table
错误是
if (length(p) > 1 & maxp * n != sum(unlist(nrows)) & maxp * n 中的错误 != :需要 TRUE/FALSE 的缺失值另外:警告 消息:在 lapply(ncols, as.integer) 中:强制引入的 NAs
也许可以用html_text写,但我需要表格格式。
感谢任何帮助
【问题讨论】:
标签: r web-scraping rvest