【问题标题】:Ruby Mechanize Parse Meta TagsRuby Mechanize Parse Meta标签
【发布时间】:2012-09-16 11:13:11
【问题描述】:

我正在使用 Mechanize 抓取一堆网页,但无法获取元标记。

<meta property="og:longitude" content="-74.0100365">
<meta property="og:latitude" content="40.7199929">

我想获取og:longitudeog:latitude 参数。我尝试的方法不起作用,可能是因为页面是动态加载的。这是我目前使用的代码:

a = Mechanize.new { |agent|
  agent.user_agent_alias = 'Mac Safari'
}

a.get(some_web_page) do |page|
  puts page.search("latitude").first.text
  puts page.search("longitude").first.text
end

【问题讨论】:

    标签: ruby html-parsing web-crawler nokogiri mechanize


    【解决方案1】:

    应该是:

    page.at('meta[property="og:longitude"]')[:content]
    page.at('meta[property="og:latitude"]')[:content]
    

    注意:content,因为它是您想要的内容属性,而不是文本。

    【讨论】:

    • 以前可以工作,但现在出现错误“*** NoMethodError Exception: undefined method `[]' for nil:NilClass”
    猜你喜欢
    • 2016-02-07
    • 2011-10-30
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2011-12-05
    • 2012-12-08
    • 2021-11-20
    • 1970-01-01
    相关资源
    最近更新 更多