【发布时间】:2020-03-16 03:53:38
【问题描述】:
我正在尝试将 HTML 字符串加载到 puppeteer 中并获取所有 <link> 标签。但是,当 HTML 字符串中有带有 href 值的 <link> 标记时,我得到了空的 <links 集。
我从 view-source:https://redis.io/ 复制了 HTML 代码作为字符串并将字符串提取为:
async function main() {
const puppeteer = require("puppeteer");
const browser = await puppeteer.launch({args: ["--no-sandbox"]});
const page = await browser.newPage();
await page.setContent(html);
await page.screenshot({path:"s.png"});
const links = await page.$$eval('link', links => links.map(link => link.href))
const singleLink = await page.$eval('link', link => link.href);
console.log(singleLink)
console.log(links);
browser.close();
}
main()
.then(() => {})
.catch(err => console.log(err))
但我得到了 links 的空列表。这可能是什么原因?
【问题讨论】:
标签: javascript node.js puppeteer google-chrome-headless