【问题标题】:Is it possible to use multiple index data directory in Apache Solr?是否可以在 Apache Solr 中使用多个索引数据目录?
【发布时间】:2015-05-01 14:35:34
【问题描述】:

我是 Apache Lucene/Solr 的新手。

我尝试从 Elasticsearch 迁移到 Apache Solr。

所以,我有一个关于以下索引数据位置配置的问题。

在 Elasticsearch 中

# 可以选择包含多个 lo # 文件 l 上的位置(a la RAID 0) # 创造空间。例如:
#
#path.data: /path/to/data1,/path/to/data2

在 Apache Solr 中

<dataDir>/var/data/solr/</dataDir>

我想在 Apache Solr 中配置多个索引数据目录,例如 Elasticsearch。

有可能吗?

我怎样才能达到目标?

Apache Solr 中是否可以有多个索引数据目录?

Apache Solr 中是否可以有多个索引数据目录?

【问题讨论】:

  • 是什么让你从 elasticsearch 转向 solr?只是好奇
  • 在我们的环境中,elasticsearch 实例的重启时间非常慢(几个小时!)。我们没有解决这个问题,所以我们尝试找到像 solr 这样的替代解决方案......

标签: solr elasticsearch lucene


【解决方案1】:

我怎样才能达到目标?

这取决于您需要多个索引目录的原因。 默认情况下,solr 不支持使用&lt;dataDir&gt; 的多个索引位置。

所以问题是:为什么需要它?

为了高可用性(对于这种情况,如果一个存储/索引路径不可用?)?还是因为性能问题?要将磁盘 I/O 分散到多个驱动器上?

在这种情况下,您应该使用其他一些 solr 功能/产品,例如 SolrClouddistributed search

【讨论】:

  • 感谢您的反馈。我认为多个索引位置对于磁盘 I/O 性能和灵活的磁盘存储大小管理更有优势。
  • SolrCloud 是否支持多个索引位置?它看起来不像这样。如果是这种情况,我如何将磁盘 I/O 分散到多个驱动器上?
【解决方案2】:

目前(2020 年 9 月)似乎没有办法使用 Solr 进行配置。

我同意,从性能角度来看,当主机有多个可用卷时,可以像使用 Cassandra、Elasticsearch 等一样传播数据。

另一种方法是在主机上运行多个实例,但这有许多其他缺点。

或者,您必须使用操作系统级别的工具(如 linux 中的 LVM)来创建一个分布在现有驱动器或文件系统中的卷。

因为我的文件系统是预先存在的,所以我不得不使用dd 创建稀疏文件,并使用lvm 创建一个逻辑块设备来包装这些文件。这不是最有效的做法,但确实有效。

【讨论】:

    猜你喜欢
    • 2013-08-16
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-10-06
    • 1970-01-01
    • 2020-12-30
    • 2018-02-15
    相关资源
    最近更新 更多