【问题标题】:How to download a complete web page (with all its contents) in Java?如何用 Java 下载完整的网页(及其所有内容)?
【发布时间】:2011-01-08 02:24:33
【问题描述】:

使用 Java,我需要保存一个完整的网页(包括其所有内容,如图像、css、javascript 等),就像我们如何使用另存为 - > 使用 HttpClient lib 的完整网页选项一样。我该怎么做?

【问题讨论】:

标签: java html download save


【解决方案1】:

你可以试试 lib curl java http://curl.haxx.se/libcurl/java/

你也可以参考这个讨论 curl-equivalent-in-java

【讨论】:

    【解决方案2】:

    您必须编写一个应用程序来获取 html 文件,对其进行解析并提取所有引用,然后获取通过解析找到的所有文件。

    【讨论】:

      【解决方案3】:

      这并不容易,因为某些 CSS/JS/Images 文件路径可能是“隐藏的”。只需考虑以下示例:

      <script type="...">
         document.write("&bla;script" + " type='...' src='" + blahBlah() + "'&bla;" + "&bla;/script&bla;");
      </script>
      

      但是,获取页面源、解析 URL 搜索并下载已创建的 URL 几乎是您可能需要的一切。

      【讨论】:

        猜你喜欢
        • 2010-12-21
        • 2010-10-25
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 2017-05-12
        • 2017-12-05
        • 1970-01-01
        相关资源
        最近更新 更多