【发布时间】:2021-05-29 11:46:15
【问题描述】:
我想在一个程序运行时进行大约 3000 次文档相似性。
我用BERT-sore的算法试了一下。但是,这个算法太重,无法完成程序运行。
所以我有一个问题。
- BERT 另一种算法
- Doc2vec
- 使用
- 其他算法
哪种算法最轻。
【问题讨论】:
标签: python nlp bert-language-model
我想在一个程序运行时进行大约 3000 次文档相似性。
我用BERT-sore的算法试了一下。但是,这个算法太重,无法完成程序运行。
所以我有一个问题。
哪种算法最轻。
【问题讨论】:
标签: python nlp bert-language-model
您可以计算 TF-IDF 来比较文档,它非常轻量级,从那里开始。
【讨论】: