【问题标题】:Spider that tosses results into mysql将结果扔进mysql的蜘蛛
【发布时间】:2009-10-29 00:50:19
【问题描述】:

希望使用 Sphinx 进行站点搜索,但并非我的所有站点都在 mysql 中。而不是重新发明轮子,只是想知道是否有一个开源蜘蛛可以轻松地将其发现放入 mysql 数据库中,以便 Sphinx 可以对其进行索引。

感谢您的建议。

【问题讨论】:

    标签: mysql sphinx web-crawler


    【解决方案1】:

    还有XML pipe 数据源可以将文档提供给Sphinx。不确定设置某些内容以将您的网站内容输出为 XML 是否比将其插入数据库更容易,但这是一种选择。

    【讨论】:

      【解决方案2】:

      如果您不是 100% 坚持使用 Sphinx,您可以考虑使用 Lucerne,就像这个网站一样?无论底层技术(数据库驱动或静态页面)如何,这都应该有效。

      我目前也在寻求实施网站搜索。 This 问题也可能有帮助。

      【讨论】:

      • 当前在具有 2 gig RAM 的同一台服务器上运行站点(nginx 和 mysql)。我可以让 Lucerne 同时在同一个盒子上运行吗?
      • 对不起,不能给出明确的是或否,因为我没有实现这一点,它取决于其他因素。不过,并排运行这两个应该不是问题,我认为这一切都取决于并发用户的数量等。我会检查你已经使用 vmstat 和 top 或等效的资源
      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2015-04-02
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-09-11
      • 2023-02-10
      • 1970-01-01
      相关资源
      最近更新 更多