【发布时间】:2015-11-24 06:18:06
【问题描述】:
为了我的自学目的(网络爬虫),我想从旅行顾问网站提取用户给出的评分。下面是我用 R 编写的代码,但它不起作用。你能建议我或给我正确的代码吗?我也没有成功使用 Rvest 包。
library(XML)
dat <- readLines("http://www.tripadvisor.in/Hotel_Review-g60763-d93450-Reviews-Grand_Hyatt_New_York-New_York_City_New_York.html", warn=FALSE)
raw2 <- htmlTreeParse(dat, useInternalNodes = TRUE)
##Rating
data <- xpathApply(raw2,"//div[@class='col2of2']//span[@class='rate sprite-rating_s rating_s']/img[@alt]",xmlValue)
Rating <- sapply(data,function(x) xmlAttrs(x)["alt"])
Result <- unlist(Rating)
Result
【问题讨论】:
-
-
感谢您告诉我。我是 R 新手,将其用于自学目的。
-
我能想到许多其他更适合“学习目的”的网站。
标签: xml r web-crawler data-extraction rvest