【问题标题】:How should I load the contents of a .txt file to serve on a website?我应该如何加载 .txt 文件的内容以在网站上提供服务?
【发布时间】:2012-02-09 02:23:52
【问题描述】:

我正在尝试为在我的网站上作为搜索结果返回的每个文档构建摘录。我在 Linux CentOS 上使用 Sphinx 搜索引擎和 Apache Web 服务器。我想使用的 Sphinx API 中的函数称为BuildExcerpts。此函数要求您传递一个字符串数组,其中每个字符串都包含文档内容。

我想知道在网络上提供结果时实时检索文档内容的最佳做法是什么。目前,这些文档位于我系统上的文本文件中,分布在多个驱动器上。它们大约有 100MM,占用了几 TB 的空间。

我可以很容易地拨打file_get_contents() 之类的电话,但这感觉是错误的做法。我的数据库已经很大(100GB+),我不想把文档内容和已经存在的文档属性一起扔进去。然而,也许这是最好的方法。

建议?

【问题讨论】:

    标签: linux apache sphinx file-get-contents


    【解决方案1】:

    源需要从某个地方获取。如果您不想在数据库中复制它,那么您需要从文件系统中获取它。 (使用 file_get_contets 或类似的)

    虽然 BuildExerpts 函数确实为您提供了一个额外的选项“load_files”

    ... 然后 sphinx 将为您从文件名中读取数据。

    从文件中读取它时遇到什么问题?是不是太慢了?如果是这样,可能会在前面使用一些缓存 - 也许使用 memcache。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 2018-08-07
      • 1970-01-01
      • 2022-08-02
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2011-09-16
      • 1970-01-01
      相关资源
      最近更新 更多