【发布时间】:2018-05-15 17:56:42
【问题描述】:
我正在尝试从搜索结果页面 (link here) 中提取产品项目名称列表。
library(rvest)
results <- read_html('https://www.fishersci.com/us/en/catalog/search/products?keyword=sodium+hydroxide&nav=')
results %>%
html_nodes(".result_title a") %>%
html_text()
返回
character(0)
我也尝试过使用:
html_attr('href')
没有运气。我什至可以使用 css 来提取这些链接的标题吗?我正在尝试列出 30 个产品结果(例如“氢氧化钠(颗粒/认证 ACS),Fisher Chemical”)。这些链接的 id 是否使用 javascript?
感谢您的帮助,这是我的第一个抓取项目,我的网页设计知识比这个特定页面简单得多。
【问题讨论】:
标签: css r web-scraping rvest