【发布时间】:2015-05-06 16:23:17
【问题描述】:
我有一个只显示 YAML 文件的网页。 无论如何我可以得到那个 YAML 文件,这样我就可以使用黄瓜项目(使用 Page Object、Capybara 和 Selenium Webdriver 并且它在 Ruby 中)保存它。
谢谢
【问题讨论】:
-
看起来有点矫枉过正。假设这是可能的,您是否不必解析 HTML 后下载?有没有办法直接从应用程序而不是通过网站获取这些数据?
-
不,我获得此信息的唯一方法是访问此网页。我想知道的是,是否有一种方法可以提取 YAML,而不仅仅是带有空格的 html 文本,这样我就不需要将它解析回 YAML。
-
我没有看到 HTML 代码。所以很难回答你的问题。但是您可以获取具有 YAML 的元素的 innerText,然后对其进行解析。您可以使用 Selenium 执行 Javascript 以获取 HTML 页面上元素的 innextText
-
好的,我刚刚解决了,我会发布解决方案:)
-
该网页是包含恰好是 YAML 格式的文本的 HTML 页面,还是浏览器正在转换为 HTML 页面的 YAML 文件?如果是后者,您可以使用类似
open-uri的方式直接下载 YAML 文件。
标签: ruby selenium-webdriver cucumber capybara