【发布时间】:2012-09-16 11:13:11
【问题描述】:
我正在使用 Mechanize 抓取一堆网页,但无法获取元标记。
<meta property="og:longitude" content="-74.0100365">
<meta property="og:latitude" content="40.7199929">
我想获取og:longitude 和og:latitude 参数。我尝试的方法不起作用,可能是因为页面是动态加载的。这是我目前使用的代码:
a = Mechanize.new { |agent|
agent.user_agent_alias = 'Mac Safari'
}
a.get(some_web_page) do |page|
puts page.search("latitude").first.text
puts page.search("longitude").first.text
end
【问题讨论】:
标签: ruby html-parsing web-crawler nokogiri mechanize