【发布时间】:2016-08-12 18:46:47
【问题描述】:
我正在使用wget 从网站下载所有 jpeg。
我搜索了很多,应该是这样的:
wget -r -nd -A jpg "http://www.hotelninfea.com"
这应该递归 -r 下载文件 jpegs -A jpg 并将所有文件存储在一个目录中,而无需重新创建网站目录树 -nd
运行此命令只下载网站主页的jpeg,而不是所有网站的整个jpeg。
我知道 jpeg 文件可以有不同的扩展名(jpg、jpeg)等等,但事实并非如此,也没有任何 robots.txt 限制起作用。
如果我从上一个命令中删除过滤器,它会按预期工作
wget -r -nd "http://www.hotelninfea.com"
这发生在 Lubuntu 16.04 64 位 wget 1.17.1
这是一个错误还是我误解了什么?
【问题讨论】:
标签: web-scraping jpeg wget