【发布时间】:2021-01-20 16:38:38
【问题描述】:
我正在尝试从网站获取 pdf 文档,但我一直在获取 pdf 上的代码,而不是图片或它的“屏幕截图”。我想坚持cheerio和fs。
这是它保存的地方。
const pdf_completo = fs.createWriteStream('paginas/pdf_completo.pdf');
这是我试图用来获取它的函数。
async function obtener_pdf_pagina(){
const $ = await request({
uri: 'http://quotes.toscrape.com/',
transform: pdf => cheerio.load(pdf)
});
const todo_pagina = $('*');
pdf_completo.write(todo_pagina.html());
}
【问题讨论】:
-
此代码中的任何内容都不会创建网站的屏幕截图或图像。您所做的只是将原始 HTML 放入您的文件中。您将需要使用可以制作网站屏幕截图的库或可以将 HTML 转换为 PDF 或类似内容的库。
-
所以不能用cheerio来做这个?
标签: javascript node.js fs cheerio fs-extra