【发布时间】:2012-07-31 03:38:48
【问题描述】:
我的目标是在输入谷歌搜索词后从第一页的所有链接中提取 html。我在代理后面工作,所以这是我的方法。
1.我第一次用mechanize在表单中输入搜索词,我正确设置了代理和机器人。
2.提取链接后,我使用了一个全局使用urllib2.ProxyHandler的开启器,单独打开url。
但是这给了我这个错误。想不通。
urlopen error [Errno 8] _ssl.c:504: EOF occurred in violation of protocol
【问题讨论】:
标签: python proxy mechanize urllib2