【发布时间】:2013-11-23 22:38:09
【问题描述】:
我想抓取/抓取大量严重依赖 Javascript 的网站,而我的 Mechanize 代理(我通常使用的代理)无法处理这些网站,因为它无法呈现 html。一个很好的例子是this site。
有什么方法可以从 Ruby on Rails 应用程序中获取该站点的渲染 html 输出?
我正在使用 Ruby 2.0.0 和 Rails 4.0.1
【问题讨论】:
-
也许看看phantomjs.org
-
您的选择是弄清楚如何做或切换到像 selenium 这样的完整浏览器解决方案。
标签: javascript ruby-on-rails ruby web-crawler mechanize