【问题标题】:Freebase evaluating which fields can be right for a popularity sort heuristicFreebase 评估哪些字段适合流行排序启发式
【发布时间】:2014-07-29 16:37:03
【问题描述】:

我正在尝试获取 freebase 的子集。对于几种类型,我主要想要最流行的实体。例如,当我试图获取最受欢迎的电影时,我想要前 2k 最受欢迎的电影。我看到没有受欢迎程度排名,但每当我试图通过诸如估计预算或总收入之类的东西来限制/排序时,我得到的结果集非常小。有什么方法可以评估哪些字段可能实际相关,而不仅仅是一个在非常低百分比的结果中使用的字段?

一个简单的电影查询示例:

[{
  "type": "/film/film",
  "limit": 10,
  "name": null,
  "id": null
}]

问题是我应该考虑哪个"sort" 选项,以使其按某种流行度启发式排序?

【问题讨论】:

    标签: google-api nlp wikipedia freebase dbpedia


    【解决方案1】:

    查看此页面:

    http://wiki.freebase.com/wiki/Search_Cookbook#Scoring_and_Ranking

    上面写着:

    Freebase 实体具有在索引期间计算的固有相关性分数(排名),这是其在 Freebase 和 Wikipedia 中的入站和出站链接计数的函数

    您还可以添加其他约束或分数,如上一页所述。

    “相关性分数”仅在创建图表时可用,在使用时不可用。相反,正如链接中提到的“结果总是按最终分数排序,最高分在前”。分数是多个分数的组合,您可以选择分数的类型,例如得分:freebase等。

    【讨论】:

    • 这看起来很有趣,但我没有看到如何通过 MQL 访问该字段。在我的问题中添加了一个简单的查询示例,有什么想法吗?
    • “这个字段”是什么意思?
    • 您提到了 Freebase entities have an inherent relevance score - 我如何告诉 MQL 查询按 inherent relevance score 对结果进行排序(我认为它应该是所有类型的属性,但没有看到这样)
    • 我认为这些“相关性分数”仅在创建图表时可用,在使用时不可用。相反,正如链接中提到的“结果总是按最终分数排序,最高分在前”。分数是多个分数的组合,您可以选择分数的类型,例如得分:freebase等
    • 这不只适用于搜索 API 吗?他们写了这个:If you do not include a sort directive in a query then Metaweb makes not guarantees about the order in which results are returned. If you don't ask for the data to be sorted, you should treat the result as an unordered set of values rather than an ordered listwiki.freebase.com/wiki/…
    猜你喜欢
    • 2015-11-20
    • 2014-02-08
    • 2010-11-03
    • 1970-01-01
    • 1970-01-01
    • 2010-09-09
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多