【发布时间】:2022-01-28 16:58:02
【问题描述】:
我正在尝试使用 rvest 从以下网站抓取表 1:
以下是我写的代码:
link <- "https://www.kff.org/coronavirus-covid-19/issue-brief/u-s-international-covid-19-vaccine-donations-tracker/"
page <- read_html(link)
page %>% html_nodes("iframe") %>% html_attr("src") %>% .[11] %>% read_html() %>%
html_nodes("table.medium datawrapper-g2oKP-6idse1 svelte-1vspmnh resortable")
但是,我得到{xml_nodeset (0)} 作为结果。我正在努力找出正确的标签,以便从数据包装器页面中选择 html_nodes() 以提取表 1。
如果有人能指出我所犯的错误,或者提出解决此表的方法,我将不胜感激。
非常感谢。
【问题讨论】:
-
RSelenium解决方案是否适合您? -
我不知道如何使用RSelenium,所以从Rvest开始。不过,谢谢你的建议。下次我也会尝试 RSelenium。
标签: r web-scraping html-table