【发布时间】:2019-01-16 19:31:41
【问题描述】:
准备数据
df= rn.read_sql(sql,conn)
Data = df.as_matrix(['TOT_CLM_GROSS_AMT','UNIT_PRICE','QUANTITY'])
应用 K-means
kmeansFinal = KMeans(n_clusters = 47, init="k-means++",precompute_distances=True, copy_x=True,max_iter=500,n_init=20 ).fit(Data)
然后计算距离
distances= kmeansFinal.transform(Data)
我想打印前 n 个异常值的值
假设 n 现在是 5
【问题讨论】:
-
K-means 讨厌异常值。见this。
标签: python scikit-learn k-means