【发布时间】:2021-12-17 02:27:00
【问题描述】:
我正在尝试使用 Scikit learn 实现数据聚类算法,特别是 DBSCAN。我使用 Jaccard Index 作为我的指标。但是,DBSCAN() 没有其他模型所具有的 verbose 参数。这意味着我看不到我的 DBSCAN 处于哪个时期,而且我不知道需要多长时间。此外,根据我对聚类算法的(有些有限的)知识,如果它们陷入循环,它们可能永远无法收敛;因此,了解算法在哪个迭代中非常重要。
有什么方法可以让我在哪个时代获得 scikit 打印信息?如果没有,有没有办法自己编写这样的函数并让 scikit learn 在每个输出(或类似的东西)的末尾运行这个函数?还是我必须自己编写整个 DBSCAN() 函数才能打印出关于时代和相关准确度分数的语句?
谢谢!
【问题讨论】:
标签: scikit-learn cluster-analysis sklearn-pandas dbscan