【发布时间】:2022-10-01 15:19:30
【问题描述】:
我设计了一个对顺序时间序列数据进行聚类的变分自动编码器 (VAE)。 为了评估 VAE 在标记数据上的性能,首先,我在原始数据上运行 KMeans,并使用生成的标签与真实标签进行比较调整后的相互信息分数 (AMI).然后,在模型训练完成后,我将验证数据传递给它,在潜在向量上运行 KMeans,并使用 AMI 将生成的标签与验证数据的真实标签进行比较。最后,我比较了两个 AMI 分数,看看 KMeans 在潜在向量上的性能是否比原始数据更好。
我的问题是:当数据未标记时,我们如何评估 VAE 的性能?
我知道我们可以在原始数据上运行 KMeans 并为其生成标签,但在这种情况下,由于我们将生成的标签视为真实标签,我们如何将 KMeans 在原始数据上的性能与 KMeans 在潜在向量上的性能进行比较?
笔记:该模型是完全无监督的。训练过程中不使用标签(如果存在)。它们仅用于评估。
标签: deep-learning cluster-analysis k-means autoencoder unsupervised-learning