【问题标题】:How can I allow users to search data which is stored without reference to its URL?如何允许用户搜索存储的数据而不参考其 URL?
【发布时间】:2011-09-30 12:13:58
【问题描述】:

我想知道如何使用此约束设置搜索引擎:

在网站(小流量网站)上,存储了新闻内容,但我们不知道这些内容实际显示在哪里;我们无法猜测 URL。

您知道我必须如何以及使用哪种技术来实现此功能吗?

我想我需要一个在搜索时抓取整个网站的搜索引擎?谁能告诉我 sphynx/lucene/solr 是否合适?

【问题讨论】:

    标签: php search solr full-text-search sphinx


    【解决方案1】:

    无论您选择哪种搜索引擎,都必须为其提供足够的信息。因此,在您的约束下,您无法使用世界上的任何搜索引擎。

    当您向索引提交文档或页面时,您还必须提供足够的信息,以便能够创建显示实际内容的 URL。

    Lucene 是 Solr 使用的搜索 API。两者都是高质量的 Apache 项目,选择哪一个取决于您的要求。 Solr 为 Lucene 提供了广泛的功能,例如分面搜索和用于所有操作的 REST API。

    【讨论】:

    • 我不确定我是否同意你的观点,那么爬取整个页面的搜索引擎呢。这样做可以让我知道 URL。创建一个每天抓取整个网站一次的任务将有助于保持搜索数据库的更新。
    • 如果您抓取整个页面,您确实有足够的信息。您的约束是 we can't guess the URL
    • Johan 是对的,抓取网页的目的是文档引用是 url...
    猜你喜欢
    • 1970-01-01
    • 2015-02-15
    • 2020-07-26
    • 2020-09-26
    • 2010-10-18
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-07-20
    相关资源
    最近更新 更多