【发布时间】:2017-04-13 10:37:14
【问题描述】:
我正在尝试在 Python 3 中读取以下页面的 HTML 数据:
http://dl.nlai.ir/UI/25d36bb4-72aa-43c1-af2d-086540db8aea/LRRView.aspx
我就是这样做的:
url=str(input('\n Paste URL here: '))
url2=requests.get(url)
html=url2.text
print(html)
但它返回错误页面的内容。
我补充一下,你可能会在网络浏览器中遇到同样的错误页面,但为了避免这种情况,首先打开这个地址会解决它:
http://dl.nlai.ir/ui/forms/Index.aspx
您对正确读取数据的建议是什么?我想获取页面内容以从源页面中提取 base64 编码的字符串。
【问题讨论】:
-
您可能遇到涉及 cookie 的错误。尝试向
Index.aspx页面发出请求,解析标头中收到的cookie,然后使用cookies=my_cookies)将它们与您的请求一起传递 -
我是Python初学者,不知道怎么设置cookies。你能详细说明一下吗?谢谢
标签: python html python-requests