【发布时间】:2020-06-23 13:20:10
【问题描述】:
我正在使用 RSelenium 从在线存储库下载一系列报纸文章。到目前为止,我这样做的方式是使用remDr$screenshot() 函数,但是由于分辨率、缩放和取景的原因,我想知道是否可以直接下载显示的图片。访问页面的示例代码如下:
library(RSelenium)
rD1 <- rsDriver(browser = "firefox",port=4567L)
remDr <- rD1[["client"]]
url1<-"http://memoria.bn.br/DocReader/DocReader.aspx?"
url2<-"bib=090972_07&pesq=cangaceiro&pasta=ano%20192"
remDr$navigate(paste0(url1,url2))
通过查看页面的源代码,我注意到图像托管在缓存 url cache/2286106490137/I0000051-20Alt=000869Lar=000615LargOri=005060AltOri=007149.JPG(id 为DocumentoImg)中。有没有办法直接从这个地址下载,不依赖截图?
【问题讨论】:
标签: java r image browser-cache rselenium