【问题标题】:Storing solr data with amazon s3使用 amazon s3 存储 solr 数据
【发布时间】:2015-04-15 12:49:29
【问题描述】:

我在亚马逊 ec2 上使用 solr,我希望配置 solr 实例,以便它自动将数据存储在 amazon s3 中,而不是服务器上的任何位置。但是,我找不到有关如何实现此功能的任何有用信息。有谁知道怎么做?如果使用 amazon s3 无法实现这一点,您推荐什么云存储?

提前致谢。

【问题讨论】:

  • 我对 Solr 不熟悉。它如何存储它的索引数据?平面文件?数据库?该网站说它是可扩展的。它如何跨多个实例扩展?
  • 我也是 solr 的新手。据我所知,它不存储平面文件。至于可扩展性,我认为这是因为您可以将所有 solr 实例配置为使用相同的 solr 核心。
  • 我也在寻找这个问题的答案,因为我找不到相同的配置,甚至没有任何有用的链接。

标签: amazon-web-services solr amazon-ec2 amazon-s3


【解决方案1】:

您需要将 Solr 索引存储在 EBS 卷上,您可以将其附加到服务器。 S3 用于将文件直接提供给 Internet(例如图像和 css 文件),或用于一般文件存储(例如备份)。它不适合用作数据库的挂载磁盘。

Solr 喜欢非常高的 IO,因此 SSD 支持的 EBS 卷非常适合此操作。您还可以制作 EBS 卷的快照以备份其数据。

如果您设置了 Solr 从站,您也可以不使用服务器的临时存储。这是大多数实例类型附带的一个大分区。它是易失性存储,这意味着如果服务器关闭,所有数据都会丢失。但是,它是免费的,而且速度非常快。它非常适合从由 EBS 支持的主 Solr 实例复制其数据的从站。

【讨论】:

  • 嗨 Xevo。你能告诉我更多关于你正在谈论的这个 Solr slave 的细节吗?我认为这对我来说是正确的解决方案,但我不太明白....
  • 哦,我还要提一下 AWS 有自己的搜索服务 CloudSearch:aws.amazon.com/cloudsearch 该服务基于 Solr,但由 Amazon 管理。它不支持 Solr 提供的所有高级功能。但是,如果您的搜索需求不太复杂,那就太好了。
  • 至于设置slave,这个wiki页面是我用来设置的:wiki.apache.org/solr/SolrReplication
  • Solr 4.0 还支持一种称为 SolrCloud 的新复制类型(不要与 Amazon 的 CloudSearch 混淆!)。现在,这是 Solr 开发人员推荐用于复制的功能。不过设置起来有点困难:cwiki.apache.org/confluence/display/solr/SolrCloud
  • 非常感谢 Xevo! XD
猜你喜欢
  • 2017-11-10
  • 2016-08-25
  • 1970-01-01
  • 2017-04-22
  • 1970-01-01
  • 1970-01-01
  • 2011-01-04
  • 2023-03-31
  • 1970-01-01
相关资源
最近更新 更多