【发布时间】:2020-01-30 23:59:44
【问题描述】:
我想使用 Watson discovery V1 API 进行相关性培训。我尝试了以下但还没有得到想要的结果。下面详细描述问题:
我有一组文档,其中一些包含单词'cloud' 或'big data'。我想用query() api 搜索单词'hadoop' 并取回那些文档,但发现查询什么也没返回。
现在,我想为发现提供以下训练示例以更新相关性分数,以便我得到这些结果(我使用 查询扩展 来完成相同的任务并且它有效,现在我对相关性培训感兴趣)。
我已使用 api add_training_data() 将查询 'hadoop' 与相关文档(由 id 指定,例如包含 'cloud' 的文档)关联。
现在训练数据如下所示:
{
"natural_language_query": "hadoop",
"filter": "",
"examples": [
{
"document_id": "1ad6f551-e092-4ce9-b08c-eb4f4cbc9458",
"cross_reference": "",
"relevance": 1,
"created": "2020-01-30T23:16:19.674Z",
"updated": "2020-01-30T23:16:19.716Z"
},
{
"document_id": "f1d11f51-31b2-414f-b359-d5336b019575",
"cross_reference": "",
"relevance": 1,
"created": "2020-01-30T23:16:19.674Z",
"updated": "2020-01-30T23:16:19.722Z"
},
{
"document_id": "5bfcea6a-c925-4db5-a490-89a9d1de8d4c",
"cross_reference": "",
"relevance": 1,
"created": "2020-01-30T23:16:19.674Z",
"updated": "2020-01-30T23:16:19.729Z"
},
{
"document_id": "bf07e701-6893-428c-ab16-c5446e821291",
"cross_reference": "",
"relevance": 1,
"created": "2020-01-30T23:16:19.674Z",
"updated": "2020-01-30T23:16:19.735Z"
},
{
"document_id": "75082812-5c96-4d2e-b388-821a0434ad4c",
"cross_reference": "",
"relevance": 1,
"created": "2020-01-30T23:16:19.674Z",
"updated": "2020-01-30T23:16:19.742Z"
}
],
"query_id": "cc1d3677eeafe70929aeccfb462860439f61b051",
"created": "2020-01-30T23:16:19.677Z",
"updated": "2020-01-30T23:16:19.677Z"
}
其中文档 ID 对应于集合中的文档,即包含单词 'cloud' 的文档。例如
创建了训练数据后,现在我想使用查询文本 'hadoop' 再次运行之前的查询,假设发现会自动训练自己以获取相关结果(因为我找不到任何类似的 api 'train()' 我期待的)。但是,即使在提供了训练示例之后,发现查询仍然没有返回任何内容。
我不知道出了什么问题。一些帮助将不胜感激。
【问题讨论】:
标签: python machine-learning ibm-watson information-retrieval discovery