【发布时间】:2015-02-12 18:15:23
【问题描述】:
我对 R 还很陌生,无法从福布斯网站提取数据。
我目前的功能是:
网址 =
http://www.forbes.com/global2000/list/#page:1_sort:0_direction:asc_search:_filter:All%20industries_filter:All%20countries_filter:All%20states
data = readHTMLTable(url)
但是,福布斯网站在链接中以“#”符号锚定。为了解析我想要的数据,我下载了 rselenium 包,但是我对 reselenium 不太熟悉。
是否有人对 reselenium 有任何建议/专业知识,以及如何使用 reselenium 从福布斯提取数据?理想情况下,我想从网站的第 1 页、第 2 页等中提取数据。
谢谢!
【问题讨论】:
标签: r selenium anchor-scroll