【问题标题】:Is there any K-means++ implementation outside of scikit-learn for Python 2.7?在 Python 2.7 的 scikit-learn 之外是否有任何 K-means++ 实现?
【发布时间】:2017-01-27 05:25:00
【问题描述】:

我并不反对 scikit-learn,但我必须安装 anaconda 才能获得它,这有点突兀。

【问题讨论】:

  • 例如scipy。但有些人说这是超级慢。 (在 Windows 等某些系统上安装 scipy 和较小范围的 scikit-learn 并不那么容易的原因是需要速度 -> cython、blas、fortran 有很多工具可以用来提高速度;我总是更喜欢 安装 anaconda 让您有机会通过简单的设置使用最好的工具!)
  • scipy中的kmeans没有实现kmeans++,它随机采样,运行多次采样,返回最佳结果。
  • 我的错。我没有仔细阅读它!但是kmeans++中的初始化非常简单,可以自己实现。我仍然会坚持使用 scikit-learn,但好吧......
  • 我做过(在 python 中),但它有点慢;我想我会坚持使用 Anaconda,也许可以实现这个:vldb.org/pvldb/vol5/p622_bahmanbahmani_vldb2012.pdf
  • @Eduardo 我之前已经实现过,它运行速度相当快,应该可以在 python 2.7 上运行(我只在 py3 上使用过,所以不能保证):github.com/tttthomasssss/clustering/blob/master/…

标签: python-2.7 scipy scikit-learn k-means


【解决方案1】:

所以,目前的情况是:除了 scikit-learn 之外,没有分布式 Python 实现 KMeans++。如果一个好的实现进入 scipy,这种情况可能会改变。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2013-10-12
    • 2018-03-03
    • 2014-08-14
    • 2018-01-29
    • 2021-05-04
    • 2021-01-19
    • 2016-11-06
    • 2012-06-29
    相关资源
    最近更新 更多