【发布时间】:2010-09-29 23:11:59
【问题描述】:
到目前为止我做了什么..
sudo gem install scrapi
sudo gem install tidy
这不起作用,因为它没有 libtidy.dylib
所以我这样做了:
sudo port install tidy
sudo cp libtidy.dylib /Library/Ruby/Gems/1.8/gems/scrapi-1.2.0/lib/tidy/libtidy.dylib
然后我开始关注简单的 railscast:http://media.railscasts.com/videos/173_screen_scraping_with_scrapi.mov
在贝茨先生完成scrapitest.rb 的第一次保存后,我尝试运行此代码:
require 'rubygems'
require 'scrapi'
scraper = Scraper.define do
process "title", :page_name => :text
result :page_name
end
uri = URI.parse("http://www.walmart.com/search/search-ng.do?search_query=lost+season+3&ic=48_0&search_constraint=0")
p scraper.scrape(uri)
使用此代码:
ruby scrapitest.rb
它返回了这个错误:
/Library/Ruby/Gems/1.8/gems/tidy-1.1.2/lib/tidy/tidybuf.rb:39: [BUG] Segmentation fault
ruby 1.8.7 (2009-06-12 patchlevel 174) [universal-darwin10.0]
Abort trap
完全没有想法..
【问题讨论】:
标签: ruby-on-rails ruby screen-scraping web-scraping