【发布时间】:2016-10-20 12:09:15
【问题描述】:
如果我在浏览器中单击下载按钮,将下载一个文件及其原始名称和元数据。
目前我可以使用 python 请求下载文件,但我必须给它一个名称,并且下载的文件中没有任何元数据可用。
我要下载的文件具有有意义的名称,但这些名称不是 url 的一部分。
用 python 最好的方法是什么?
响应中只有这些标头:
- 服务器
- 日期
- 内容类型
- 连接
- 变化
- X-Powered-By
- 编译指示
- 设置 Cookie
- 过期
- 缓存控制
- 链接
- 内容编码
Content-Disposition 标头在r.headers 中不可用,但如果我在浏览器中下载文件,我可以看到它。
Traceback (most recent call last):
File "download.py", line 53, in <module>
print r.headers["Content-Disposition"]
File "/Users/raitis.dembovskis/.virtualenvs/webcrawler/lib/python2.7/site-packages/requests/structures.py", line 54, in __getitem__
return self._store[key.lower()][1]
KeyError: 'content-disposition'
【问题讨论】: