【发布时间】:2011-06-13 18:08:36
【问题描述】:
我需要在我的 linux 服务器上存档完整的页面,包括任何链接的图像等。寻找最佳解决方案。有没有办法保存所有资产,然后重新链接它们以在同一个目录中工作?
我曾考虑过使用 curl,但我不确定如何进行所有这些操作。另外,我可能需要 PHP-DOM 吗?
有没有办法在服务器上使用firefox并在地址加载后复制临时文件或类似的?
欢迎任何和所有输入。
编辑:
看起来 wget 似乎“不”会工作,因为需要渲染文件。我在服务器上安装了firefox,有没有办法在firefox中加载url,然后抓取临时文件并清除临时文件?
【问题讨论】:
-
所有内容都是静态的,还是也有动态内容(PHP、JSP 等)?
-
这是客户端 Web 应用程序的一部分,因此可能有任何内容。最好甚至使用 javascript 或 java 或类似的方式将当前浏览器状态发送到服务器,然后执行其他需要的操作。
-
命令
wget -p http://example.com保存必要的页面和对象,但不幸的是它不会改变路径。 -
我发现这个问题很有用!
标签: linux curl save webpage wget