【问题标题】:Algorithm for relevance/matching tree of value相关性/匹配值树的算法
【发布时间】:2011-09-02 19:36:59
【问题描述】:

对于我在下面要描述的内容,是否有模式/算法的名称?...

假设你有一棵像这样的相关数据树:

  • IDE
    • 视觉工作室
      • Visual Studio 2008
      • Visual Studio 2010
    • 日食

然后我有一个对象,其中包含对“Visual Studio 2010”的引用。

然后我在这个对象上进行“Visual Studio”的相关性搜索,并想知道这个匹配的相关性。

在通过单独设置节点之间的特定值来构建树时,这是最好的做法,还是我可以/应该设置,例如,一层距离为 10 点,两层距离为 5 点等等?

多个节点可能会链接到多个其他节点。或者这是一个坏主意? Visual Studio 也是一个“微软软件”等等。

这也可以做成2路吗?在树上和树下都有点。

这是我测试和构建某种相关性引擎的最初想法。请帮助我走上某种轨道。

【问题讨论】:

    标签: algorithm matching relevance


    【解决方案1】:

    这是一大罐虫子,如果这是手波和一般的,请原谅我。您可以在此数据结构中构建各种关系。目前,您有一个关系分类。您还提到了另一类“Microsoft 软件”,它将跨越您的分类。然后你就可以进入has-a关系等等。

    更一般地说,您说的是an ontology。虽然有大量关于如何构建和搜索它们的研究,但我不知道有任何大型项目以编程方式构建了丰富的本体,即使您让专家手动构建本体,也并不总是很清楚如何为“相关引擎”加权。我不是这些东西的最前沿,但大多数效果最好的信息检索技术是在简单结构上运行的统计技术,而不是具有丰富结构化数据模型的技术。

    我认为你在正确的轨道上。我的建议 - 尽可能简单。我会将层次结构构建为一般图,并根据图距离建立相关性,如有必要,在每条边上设置权重。双向性在这里也很好,因此您可以根据需要对泛化/规范进行惩罚。这里没有真正的食谱方法,您必须尝试

    【讨论】:

    • 这个问题很笼统而且很笼统,所以没有什么可以原谅的:P
    猜你喜欢
    • 2012-07-07
    • 2010-11-19
    • 2011-01-07
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-09-12
    • 1970-01-01
    相关资源
    最近更新 更多