【发布时间】:2019-09-11 08:12:24
【问题描述】:
我可以看到,在the English spaCy models 中,中型模型的性能优于小型模型,而大型模型的性能优于中型模型 - 但仅略胜一筹。但是,在模型的描述中,写到它们都在 OntoNotes 上接受过训练。例外是 md 和 lg 的向量,它们已在 CommonCrawl 上进行过训练。因此,如果所有模型都是在同一个数据集(OntoNotes)上训练的,唯一的区别是向量,那么为什么不需要向量的任务会有性能差异呢?我很想了解更多关于每个模型及其训练设置等的信息,但似乎这些信息并不容易获得。
【问题讨论】:
标签: spacy language-model