【问题标题】:Relevance percentage( searchstring is more "left" in sourcestring)相关百分比(搜索字符串在源字符串中更“左”)
【发布时间】:2011-08-27 06:29:02
【问题描述】:

谁能帮忙选择算法。

比较两个字符串并给出相关百分比(如果找到更多,则更多排名)。 也许合并两个算法 例如: 寻找"chocolate white quills" 我们有记录

CHOCOLATE, WHITE/DARK QUILLS [MONA LISA, 4 #/CS]
CHOCOLATE, WHITE QUILLS [SWISS CHALET, 900 GR BOX]
PASTRY INGR., CHOCOLATE QUILLS WHITE [SWISS CHALET FINE FO, 16 / 120 CT]

结果一定是这样的:

CHOCOLATE, WHITE QUILLS [SWISS CHALET, 900 GR BOX] | 0,1
CHOCOLATE, WHITE/DARK QUILLS [MONA LISA, 4 #/CS] | 0,2
PASTRY INGR., CHOCOLATE QUILLS WHITE [SWISS CHALET FINE FO, 16 / 120 CT] | 0,4

如你所见,它不是强比较,必须使用 我现在使用JaroWinkler 现在结果是这样的

CHOCOLATE, WHITE/DARK QUILLS [MONA LISA, 4 #/CS] | 0,3775
CHOCOLATE, WHITE QUILLS [SWISS CHALET, 900 GR BOX] | 0,3769
PASTRY INGR., CHOCOLATE QUILLS WHITE [SWISS CHALET FINE FO, 16 / 120 CT] | 0,3728

【问题讨论】:

    标签: c# sql-server algorithm clr relevance


    【解决方案1】:

    对于任何文本排名,您都需要明确说明您要衡量的内容。在你的例子中

    CHOCOLATE, WHITE QUILLS [SWISS CHALET, 900 GR BOX] | 0,1
    CHOCOLATE, WHITE/DARK QUILLS [MONA LISA, 4 #/CS] | 0,2
    PASTRY INGR., CHOCOLATE QUILLS WHITE [SWISS CHALET FINE FO, 16 / 120 CT] | 0,4
    

    为什么第一项排名低于第二项?我有点理解为什么底部的评分最高,因为它包含字符串中的所有项目而没有中间字符串。请提供更多详细信息,我们会尽力提供帮助。

    【讨论】:

    • 我在第一行寻找短语“chocolate white quills”,它在行中间的最后一个字符串搜索字符串中的“更左”行中建立。这就是为什么我需要这种排序。如果我在行中找到我的搜索字符串“更左”。我必须在“顶部”中显示这一行,其他必须更低
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2016-11-30
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多