【发布时间】:2010-12-28 12:38:01
【问题描述】:
我正在尝试使用 urllib2 从网页中获取数据。该页面在浏览器上可见,但通过脚本我不断收到 HTTPError: HTTP Error 403: Forbidden
我还尝试通过更改用户代理字符串来模仿浏览器请求,但没有成功。
对此有什么想法吗?
【问题讨论】:
-
网站是否需要身份验证?如果是,如何跟踪用户?该网站是否使用 cookie 来跟踪经过身份验证的用户?如果是,您需要随 HTTP 请求一起发送 cookie。
-
您能否提供更多有关您用于访问上述网站的网站和代码的详细信息。这可能不是 User-Agent 的问题。
-
@Darin - 无需身份验证。饼干,我得检查一下。这是我要获取的页面的 url。 nseindia.com/content/fo/fo_underlyinglist.htm
标签: python urllib2 fetch http-status-code-403 httplib2