【发布时间】:2011-06-21 04:33:31
【问题描述】:
我想了解 lucene 在搜索过程中的得分是多少?我看到 Lucene TermVector 包含一堆统计信息,当我搜索一个词时,如何在查询时间内计算分数?
在搜索过程中是否使用了 TermVector 及其统计信息?如果有怎么办?
【问题讨论】:
标签: lucene
我想了解 lucene 在搜索过程中的得分是多少?我看到 Lucene TermVector 包含一堆统计信息,当我搜索一个词时,如何在查询时间内计算分数?
在搜索过程中是否使用了 TermVector 及其统计信息?如果有怎么办?
【问题讨论】:
标签: lucene
Similarity 类负责对文档进行评分。
Collector 迭代文档。它与Scorer 结合使用来分配分数并根据这些分数对文档进行排名。 Scorer 实例在特定条件下计算分数。有十几种不同类型的得分手。例如,TermScorer 按如下方式计算原始分数:
getSimilarity().tf(f)*weightValue
权重值来源于查询。如果在索引时打开规范化(以便查询之间的分数或多或少具有可比性),则在此之后应用规范化。规范化因子是预先计算和缓存的。