【发布时间】:2019-07-04 21:00:52
【问题描述】:
我正在开发一个网站爬虫机器人,它可以从中提取特定信息。 而且我需要在 html 文件上运行至少“准备好文档”的 javascript 函数,以便生成内容并且我可以获得它。 我怎样才能做到这一点?我看到了一个名为“rhino”的命令,但它似乎只适用于 .js 文件,该文件是一个 html 文件。你可以猜到,它里面包含了 html 和 JS。 计划是: 下载 html 文件,编辑它们的“on document ready” js 函数,获取输出,传递下一个,重复。
【问题讨论】:
-
寻找“无头网络浏览器”
-
其实我做过,暂时找不到任何可以工作的东西。
-
那你看起来不够努力 :) 或者你没有告诉我们你的问题的一部分,因为这正是无头浏览器擅长的(因为它们是为测试前端而设计的由浏览器执行的 javascript)。
标签: javascript linux terminal