【问题标题】:What is the "seed" in Weka's SimpleKMeans clusterer?Weka 的 SimpleKMeans 集群中的“种子”是什么?
【发布时间】:2016-03-02 15:01:15
【问题描述】:

我在一组数据上使用 Weka 的 SimpleKMeans 聚类器。

但我不确定种子值是什么,它的作用或它如何影响数据。

即与默认值 10 相反,较高或较低的种子值对结果有何影响?

【问题讨论】:

标签: machine-learning weka k-means


【解决方案1】:

种子只是一个随机数种子。一旦种子被固定,即使是随机算法的行为也是确定性的。 KMeans 不是确定性的,所以如果你想要可重复的结果 - 你修复一个种子。然而,种子的精确值与 KMeans 聚类的结果完全没有关系。

【讨论】:

  • 我仍然不确定这意味着什么?我读到它与初始化集群有关,但对它的实际目的感到困惑。
  • @Wolff 基本上就是说KMeans使用随机数,如果你总是使用相同的种子,你总是会得到相同的随机数。简而言之,如果您确实对相同的数据运行 KMeans 两次,如果两次都有相同的种子,您将得到完全相同的结果。如果您不使用相同的种子,则每次运行 KMeans 时结果都会有所不同。
  • @Wolff - 播种的唯一目的是确保当您在完全相同的数据上多次运行此代码时获得完全相同的结果。 KMeans 是随机的,因此如果您简单地多次运行它可能会导致许多不同的结果 - 这样您就可以“强制”它是可重复的。
  • 好的,我明白了。谢谢!
  • @lejlot,较高或较低的种子值会影响结果吗?为什么我们应该给种子 = 7 或 3
猜你喜欢
  • 2012-06-08
  • 2014-04-02
  • 1970-01-01
  • 2023-01-05
  • 2016-01-29
  • 2015-06-04
  • 2016-06-04
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多