【发布时间】:2011-11-21 12:20:36
【问题描述】:
我需要动态提取 zip 文件我不想将 zip 文件存储在我的系统中。
例子:
在http://www.newegg.com/Siteindex_USA.xml 网站上有很多类似 zip 文件的网址
<loc>
http://www.newegg.com//Sitemap/USA/newegg_sitemap_product01.xml.gz
</loc>
我需要动态解压这个 zip 文件。提取此 zip 文件后,它将提取 .xml 文件,我需要读取该 xml 文件以获取所有链接并存储在文件中。
请有人帮助我,我需要这部分代码来开发我的爬虫。
【问题讨论】:
标签: java web-crawler