【问题标题】:Need some information about Crawl Anywhere and solr需要一些关于 Crawl Anywhere 和 solr 的信息
【发布时间】:2013-11-29 07:43:50
【问题描述】:

我浏览了 Crawl Anywhere 文档,但我对它的安装步骤感到非常困惑。

  1. 我的理解是 Apache 是可选的。但是是否需要独立的 tomcat 实例进行爬网?因为我在文件夹结构中看到的,已经存在tomcat文件夹并且war文件也在那里?
  2. 我们还需要独立的 Apache solr 实例吗?
  3. 如果我们要添加postgresql数据库进行爬取,怎么做?

还请提供一些链接,以便我可以浏览它并澄清我心中的任何疑问。

【问题讨论】:

    标签: solr tomcat7 web-crawler


    【解决方案1】:
    1. 需要 Apache 才能使用管理界面。某些交互功能需要 Tomcat。您可以在没有它们的情况下进行爬网。
    2. 没有。
    3. 支持 MySQL 和 MongoDB。该代码是开源的,因此您可以添加对 postgresql 的支持。

    其他问题请尝试Google Groups

    【讨论】:

    • @klein:“你可以在没有它们的情况下爬行。” ---我无法在这方面关注你..你能解释一下吗?有什么方法可以测试我们是否完美地抓取了文档......任何功能?
    猜你喜欢
    • 2023-03-29
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2017-06-25
    • 2015-11-30
    • 2011-09-01
    相关资源
    最近更新 更多