【发布时间】:2018-08-16 00:36:05
【问题描述】:
我是 Fasttext 的新手。我已经有几个关于这个库的问题,它们对某些人来说似乎很明显,但我真的很想得到正确的直觉。非常感谢您的帮助。
首先,我说的是Fasttext的文本分类部分。根据here 提供的教程,我们正在预测给定文本的不同标签。我们是否真的为给定的测试文本分配了每个标签,并且该文本与该标签匹配的概率是多少?
第二个问题,在这种情况下,任何人都可以澄清/解释 P@1(精度为 1)和 R@1(召回率为 1)的含义,这是 Fasttext 中使用的指标吗? 我找到了一个答案 here 。但是这个答案给我带来了更多的问题:
- 在链接提供的响应中 - 那么 P@1 和 R@1 是什么? 根据那里的逻辑和解释,P@1 是一个具有 一个结果(在我们的上下文中 - 标签),其中我们可能有 1 个正确 或 1 个不正确的标签,这意味着 P@1 只能取值 0 或 1, 正确的?我们如何在这里获得概率?我们应该只是 计算所有文本样本中所有 1 的份额?如果是,是什么 是 R@1 吗?在这种情况下如何计算?什么是 R@k 一般在这种情况下?
而tutorial提供的例子中的P@1和R@1是什么,他们在那里计算了P@5和R@5,对吧?
非常感谢,
【问题讨论】:
标签: precision text-classification precision-recall fasttext