【发布时间】:2012-02-06 23:02:12
【问题描述】:
我在为 Java 中的 KMeans 集群生成代码时遇到问题。我已经知道该算法,但是很难用 java 代码编写。 我的任务是从数据库中检索数据,然后使用 KMeans 运行聚类,在这种情况下,数据首先必须以递归二叉树结构形成。 场景是
先创建父节点,如果父节点为NULL则设置global_iteration = 0
创建节点及其与父节点的关系
从数据库(我使用 JDBC)检索所有数据到父母(接下来我们称之为数据集)
如果数据集
如果数据集
从数据集计算质心(在这种情况下是 2,因为我们构建二叉树)
Cal KMeans 类
global_iteration++
对于每个数据集:继续递归。
然后我们必须创建一个类 KMeans,该类将被调用以插入到节点中。
KMeans(数据集,k,maxIteration,minChange)
备注:k=簇数,minChange:质心变化过程中的值,作为是否仍要进行聚类的参数。 Kmeans 聚类与 commong KMeans 算法相同。
非常感谢您帮助我完成这项任务:)
【问题讨论】:
-
如果这是一个家庭作业问题,请标记为这样。否则,也许您不想重新发明轮子并从互联网上获取现成的东西。
标签: java cluster-analysis data-mining k-means