【发布时间】:2012-02-09 02:23:52
【问题描述】:
我正在尝试为在我的网站上作为搜索结果返回的每个文档构建摘录。我在 Linux CentOS 上使用 Sphinx 搜索引擎和 Apache Web 服务器。我想使用的 Sphinx API 中的函数称为BuildExcerpts。此函数要求您传递一个字符串数组,其中每个字符串都包含文档内容。
我想知道在网络上提供结果时实时检索文档内容的最佳做法是什么。目前,这些文档位于我系统上的文本文件中,分布在多个驱动器上。它们大约有 100MM,占用了几 TB 的空间。
我可以很容易地拨打file_get_contents() 之类的电话,但这感觉是错误的做法。我的数据库已经很大(100GB+),我不想把文档内容和已经存在的文档属性一起扔进去。然而,也许这是最好的方法。
建议?
【问题讨论】:
标签: linux apache sphinx file-get-contents