【发布时间】:2016-07-20 06:25:24
【问题描述】:
为了对我的Doc2Vec 训练模型进行简单评估,我需要将 400 维向量转换为二维并将文档可视化为一组节点,其中任意两个节点之间的距离与其相似度成反比(高度相似的节点靠得很近)。
经过一番搜索,我找到了 MDS(多维缩放)和 sklearn MDS 库。
现在我有 220 万个向量,每个向量都有 400 个维度,我不知道如何以正确的语法以最低的成本将它们传递给 sklearn MDS 函数。我知道在 2.2M 向量之间创建相似矩阵是不可能的。
【问题讨论】:
标签: python multidimensional-array scikit-learn mds doc2vec