【问题标题】:How to achieve Data Sharding in Endeca (data partitioning)Endeca中如何实现Data Sharding(数据分区)
【发布时间】:2015-08-09 01:30:07
【问题描述】:

目前,Oracle Commerce Guided Search (Endeca) 仅支持特定于语言的分区(即,每种语言一个 MDEX)。对于具有庞大数据量基础的系统(比如约 200 个存储的约 1 亿条记录),是否有人成功地实现了基于逻辑数据组的数据分区(分片)(即,每个存储组一个 MDEX)数据集可以分成更小的数据集吗?

如果是这样,在索引数据和查询汇编器的策略时应采取哪些预防措施?

【问题讨论】:

  • 我认为您正在寻找的是Federated SearchEnterprise Search,您的数据源恰好都具有相同的数据类型。实际的解决方案将非常特定于您的数据,并且在此处进行解释将比 SO 答案中所能做的更多。可以说它可以通过 Oracle Commerce 和 Oracle Commerce Guided Search 完成。
  • @radimpe - 任何指向此类设计的链接/指针将不胜感激,因为谷歌搜索在这里没有帮助。

标签: sharding endeca oracle-commerce


【解决方案1】:

不要认为这是可能的。 Endeca 曾经支持 Adgidx,它允许您拆分或分片 mdex,但不再受支持。 Oracle 删除此问题的理由是,对于多线程和多核处理器,不再需要它。然而,Apache Solr 支持共享

【讨论】:

    【解决方案2】:

    可以将大型数据集分解为较小的数据集,其中每个数据集都将归属于一个属性,例如 record.type,该属性将标识不同的数据集。所以,基本上我们正在规范化 Endeca 索引中的记录。

    现在,在查询 endeca 时,我们可以使用记录关系导航查询的概念,通过应用关系过滤器使用记录-记录关系,带回不同类型的记录。 但是,您可能必须获得 RRN 许可证才能在 mdex 引擎中启用 RRN 功能。

    【讨论】:

      猜你喜欢
      • 2023-04-03
      • 1970-01-01
      • 2022-11-07
      • 1970-01-01
      • 2023-04-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2018-07-27
      相关资源
      最近更新 更多