【发布时间】:2013-02-04 09:24:49
【问题描述】:
两天大的 Python(和编程)新手,所以请温柔一点。
我从 Twitter 上抓取了大约 1500 个缩短的 URL。它们都采用以下格式:http://t.co/...
用它来扩展短网址:
import urllib2
a = urllib2.urlopen('http://t.co/..')
print a.url
最后两行使用不同的 URL 重复了大约 1500 次。
只要 URL 指向的页面存在,它就可以正常工作,但是当它不存在时,会出现错误消息并在该点停止。我应该在代码中添加什么,以便它返回“找不到页面”并继续到下一个 URL 并不停地遍历整个列表。
【问题讨论】:
标签: python web web-scraping