【发布时间】:2020-08-26 10:06:43
【问题描述】:
我有一堆高维数据,这些实例是否被标记为异常值。我希望了解这些异常值在数据中的位置。我试图回答以下问题:
- 异常值是否彼此相距很远?还是它们聚集在一起?
- 异常值是否位于良好数据集群的“中间”?还是它们位于数据的“边缘”边界?
- 如果异常值聚集在一起,这些集群密度与良好数据的集群相比如何?
- 异常值在哪里?
什么样的技术可以让我找到这些见解?如果数据是 2 或 3 维的,我可以轻松地绘制数据并查看。但是高维数据我做不到。
【问题讨论】:
-
这可能更适合统计网站 Cross Validated SE。
-
你有几个维度?它是什么样的数据?
标签: data-visualization cluster-analysis outliers anomaly-detection