【发布时间】:2020-04-29 14:59:37
【问题描述】:
我正在尝试从this site 的表格中抓取一些高中体育成绩,但 rvest html_table() 函数什么也不返回……只是一个空列表。数据似乎清楚地位于 table 标记中,所以我认为这很简单,但并非如此。
html_data <- read_html("https://highschoolsports.nj.com/boysbasketball/schedule/2020/01/09")
html_data %>% html_table(html_data)
任何有关如何提取此表的帮助或建议将不胜感激!
【问题讨论】:
-
您在第二行中缺少一两步,您从整页中提取包含所需表的节点,然后将该特定节点传递给对
html_table的调用。 -
看起来该表也是用 javascript 渲染的,这使得抓取更加困难。您可能需要深入研究该主题才能到达您想去的地方。
标签: r web-scraping rvest