【问题标题】:Training Watson Discovery with (V1) python SDK APIs does not work使用 (V1) python SDK API 训练 Watson Discovery 不起作用
【发布时间】:2020-01-30 23:59:44
【问题描述】:

我想使用 Watson discovery V1 API 进行相关性培训。我尝试了以下但还没有得到想要的结果。下面详细描述问题:

我有一组文档,其中一些包含单词'cloud''big data'。我想用query() api 搜索单词'hadoop' 并取回那些文档,但发现查询什么也没返回。

现在,我想为发现提供以下训练示例以更新相关性分数,以便我得到这些结果(我使用 查询扩展 来完成相同的任务并且它有效,现在我对相关性培训感兴趣)。

我已使用 api add_training_data() 将查询 'hadoop' 与相关文档(由 id 指定,例如包含 'cloud' 的文档)关联。

现在训练数据如下所示:

{
  "natural_language_query": "hadoop",
  "filter": "",
  "examples": [
    {
      "document_id": "1ad6f551-e092-4ce9-b08c-eb4f4cbc9458",
      "cross_reference": "",
      "relevance": 1,
      "created": "2020-01-30T23:16:19.674Z",
      "updated": "2020-01-30T23:16:19.716Z"
    },
    {
      "document_id": "f1d11f51-31b2-414f-b359-d5336b019575",
      "cross_reference": "",
      "relevance": 1,
      "created": "2020-01-30T23:16:19.674Z",
      "updated": "2020-01-30T23:16:19.722Z"
    },
    {
      "document_id": "5bfcea6a-c925-4db5-a490-89a9d1de8d4c",
      "cross_reference": "",
      "relevance": 1,
      "created": "2020-01-30T23:16:19.674Z",
      "updated": "2020-01-30T23:16:19.729Z"
    },
    {
      "document_id": "bf07e701-6893-428c-ab16-c5446e821291",
      "cross_reference": "",
      "relevance": 1,
      "created": "2020-01-30T23:16:19.674Z",
      "updated": "2020-01-30T23:16:19.735Z"
    },
    {
      "document_id": "75082812-5c96-4d2e-b388-821a0434ad4c",
      "cross_reference": "",
      "relevance": 1,
      "created": "2020-01-30T23:16:19.674Z",
      "updated": "2020-01-30T23:16:19.742Z"
    }
  ],
  "query_id": "cc1d3677eeafe70929aeccfb462860439f61b051",
  "created": "2020-01-30T23:16:19.677Z",
  "updated": "2020-01-30T23:16:19.677Z"
}

其中文档 ID 对应于集合中的文档,即包含单词 'cloud' 的文档。例如

创建了训练数据后,现在我想使用查询文本 'hadoop' 再次运行之前的查询,假设发现会自动训练自己以获取相关结果(因为我找不到任何类似的 api 'train()' 我期待的)。但是,即使在提供了训练示例之后,发现查询仍然没有返回任何内容。

我不知道出了什么问题。一些帮助将不胜感激。

【问题讨论】:

    标签: python machine-learning ibm-watson information-retrieval discovery


    【解决方案1】:

    桑迪潘,

    这里提到:Improving result relevance with the API

    当您向 Discovery 实例提供训练数据时,该服务 使用机器学习 Watson 技术在您的 内容和问题。然后该服务将查询结果重新排序到 在顶部显示最相关的结果。随着您添加更多培训 数据,服务实例变得更加准确和复杂 它返回的结果的排序

    我相信相关性培训不会按您需要的方式进行。它只会重新排序。

    此外,“集合的训练数据集必须包含至少 49 个唯一的训练查询(即查询和示例集)。”。您需要添加更多查询才能开始训练。

    【讨论】:

    • 感谢您的回复,您还知道其他什么方法可以用更少的训练示例进行发现吗?
    • 没有。我遇到了一个情况,我不得不输入一个大于 50 的数字,因为我的例子不够多样。如果您发现了,请分享!
    猜你喜欢
    • 1970-01-01
    • 2016-07-23
    • 1970-01-01
    • 1970-01-01
    • 2019-08-01
    • 2016-10-29
    • 1970-01-01
    • 1970-01-01
    • 2020-03-26
    相关资源
    最近更新 更多