【发布时间】:2022-01-15 00:58:35
【问题描述】:
我正在尝试使用 Python requests 从 PeerJ 下载 PDF。例如,https://peerj.com/articles/1.pdf。
我的代码很简单:
r = requests.get('https://peerj.com/articles/1.pdf')
但是,返回的 Response 对象显示为 <Response [432]>,这表示 HTTP 432 错误。据我所知,该错误代码未分配。
当我检查 r.text 或 r.content 时,有一些 HTML 表明这是一个错误 432,并提供了指向同一 PDF 的链接,https://peerj.com/articles/1.pdf。
当我在浏览器 (Chrome) 中打开 PDF 时,我可以查看它。
如何获取实际的 PDF(作为 bytes 对象,就像我应该从 r.content 获取一样)?
【问题讨论】:
标签: python pdf python-requests