【发布时间】:2014-10-08 02:22:36
【问题描述】:
我有很多 url 地址,我想在下面应用这两行代码:
a <- htmlTreeParse("url address",useInternal=T,encoding='UTF-8')
d <- xpathSApply(a,"//div[@class='text']",xmlValue)
我该怎么做?
我试过了:
urls <- read.table("file.txt") #txt file with all url's
for(i in 1:200){
a <- 1:200
c <- 1:200
d <- 1:200
a[i]<-as.character(urls[i,])
c[i] <- htmlTreeParse(a[i],useInternal=T,encoding='UTF-8')
d[i] <- xpathSApply(c[i],"//div[@class='text']",xmlValue)
}
我在上面代码中的问题是xpathSApply 函数使用类XMLInternalDocument 的对象,所以c[i] 应该属于该类。但我不知道我该怎么做
【问题讨论】:
-
所有这些 url 从哪里填充?
-
我有一个包含所有内容的 txt 文件
标签: r for-loop web-scraping