【发布时间】:2022-01-23 05:43:29
【问题描述】:
我正在尝试下载一个嵌入的 pdf 文件或获取其原始内容以使用带有 Python 的 PlayWright 将其存储在一个变量中。我得到 page.content() 的以下输出:
''
我找不到下载按钮或打印按钮
【问题讨论】:
-
请提供足够的代码,以便其他人更好地理解或重现问题。
标签: python html pdf playwright
我正在尝试下载一个嵌入的 pdf 文件或获取其原始内容以使用带有 Python 的 PlayWright 将其存储在一个变量中。我得到 page.content() 的以下输出:
''
我找不到下载按钮或打印按钮
【问题讨论】:
标签: python html pdf playwright
当您访问该页面时,playwright/chrome 将需要发送网络请求以检索您正在查看的 PDF。只需拦截该请求,并将响应主体作为缓冲区获取。
如果您只是直接导航到 PDF,我认为这样的方法会起作用:
response = page.goto(url)
print(response.status)
body = response.body()
# Open file in binary write mode
pdf_file = open('file.pdf', 'wb')
# Write bytes to file
pdf_file.write(body)
# Close file
pdf_file.close()
【讨论】: