【发布时间】:2019-01-16 07:21:48
【问题描述】:
我尝试到处寻找,但似乎没有任何效果。我正在尝试对包含纬度和经度的 902,538 个数据点进行聚类,但我似乎无法使其工作!我尝试了各种聚类方法,但不明白什么不起作用。有什么建议吗?
dfnypd 是一份犯罪报告,其中包括给定时间范围内纽约所有报告的犯罪的纬度和经度。
这是我尝试过的代码之一 - 给我一个 ValueError: n_samples=2 should be >= n_clusters = 100
dfnypd = dfnypd[['Latitude','Longitude']].apply(pd.to_numeric)
clat = dfnypd['Latitude']
clon = dfnypd['Longitude']
from sklearn.cluster import KMeans
X = np.array(([clat, clon]))
kmeans = KMeans(n_clusters = 100, random_state = 0).fit(X)
我将它分组,以便我可以将它们绘制在可读的图表上,并根据在这些集群中犯下的罪行为不同的集群分配权重。我尝试将其全部绘制为热图,但它需要太多的能量。
【问题讨论】:
标签: python cluster-analysis k-means folium