【发布时间】:2015-03-20 20:22:35
【问题描述】:
我对 python 有点陌生,但我正在尝试制作一个网络爬虫脚本,它可以下载网站上的所有图片。我正在使用 requests 和 PyQuery,因为很多人在研究后推荐了它。这就是我现在所拥有的一切,我不知道该去哪里。
r = requests.get("some url")
images = pq(r.text)
for image in images.find("img"):
我知道我需要获取 img 的来源,但是在找到 img 标签后我该怎么做呢?另外,我查看了一些 html 的页面源,一些图片存储在他们的数据库中,所以 src 以“/”一些扩展名开头,所以我想知道如何才能获得完整的 url。
【问题讨论】:
-
你可以在这里查看我的答案stackoverflow.com/questions/43982002/…,这与你的相似。