【发布时间】:2017-01-27 05:25:00
【问题描述】:
我并不反对 scikit-learn,但我必须安装 anaconda 才能获得它,这有点突兀。
【问题讨论】:
-
例如scipy。但有些人说这是超级慢。 (在 Windows 等某些系统上安装 scipy 和较小范围的 scikit-learn 并不那么容易的原因是需要速度 -> cython、blas、fortran 有很多工具可以用来提高速度;我总是更喜欢 安装 anaconda 让您有机会通过简单的设置使用最好的工具!)
-
scipy中的kmeans没有实现kmeans++,它随机采样,运行多次采样,返回最佳结果。
-
我的错。我没有仔细阅读它!但是kmeans++中的初始化非常简单,可以自己实现。我仍然会坚持使用 scikit-learn,但好吧......
-
我做过(在 python 中),但它有点慢;我想我会坚持使用 Anaconda,也许可以实现这个:vldb.org/pvldb/vol5/p622_bahmanbahmani_vldb2012.pdf
-
@Eduardo 我之前已经实现过,它运行速度相当快,应该可以在 python 2.7 上运行(我只在 py3 上使用过,所以不能保证):github.com/tttthomasssss/clustering/blob/master/…。
标签: python-2.7 scipy scikit-learn k-means