【问题标题】:Which algorithm for **DOCUMENT SIMILARITY** is reasonable for calculating on local machine?**DOCUMENT SIMILARITY** 的哪种算法在本地计算机上计算是合理的?
【发布时间】:2021-05-29 11:46:15
【问题描述】:

我想在一个程序运行时进行大约 3000 次文档相似性

我用BERT-sore的算法试了一下。但是,这个算法太重,无法完成程序运行。

所以我有一个问题。

  • BERT 另一种算法
  • Doc2vec
  • 使用
  • 其他算法

哪种算法最轻。

【问题讨论】:

    标签: python nlp bert-language-model


    【解决方案1】:

    您可以计算 TF-IDF 来比较文档,它非常轻量级,从那里开始。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 2014-04-29
      • 1970-01-01
      • 1970-01-01
      • 2011-06-14
      • 2017-11-01
      • 1970-01-01
      • 2012-04-11
      相关资源
      最近更新 更多