【问题标题】:Output index of ELKIELKI的输出指标
【发布时间】:2019-05-11 12:26:30
【问题描述】:

我正在使用 ELKI 对 CSV 文件中的数据进行聚类

我用

-resulthandler ResultWriter
-out folder/

保存输出数据

但作为输出,我有一些奇怪的索引

ID=2138 0.1799 0.2761
ID=2137 0.1797 0.2778
ID=2136 0.1796 0.2787
ID=2109 0.1161 0.2072
ID=2007 0.1139 0.2047

尽管我的训练样本少于 100 个,但 ID 超过 2000

【问题讨论】:

    标签: output cluster-analysis data-mining dbscan elki


    【解决方案1】:

    DBID 是内部的;文档清楚地表明您不应该对它们做出过多的假设,因为它们的实现可能会发生变化。将它们写入输出的唯一原因是某些方法(例如 OPTICS)可能需要通过此唯一 ID 交叉引用对象。

    因为它们是唯一的标识符,它们通常是连续递增的。下次你在 MiniGUI 中点击“运行”,你会得到接下来的 n 个 ID……很明显,你点击了不止一次运行。

    ELKI DBID 文档中的“提示和技巧”可能会回答您的基本问题 - 如何将 DBID 映射到输入文件的行号。最好的方法是如果您想拥有对象标识符,请自己分配对象标识符,方法是使用标识符列(并将其配置为外部标识符)。

    有关详细信息,请参阅文档:https://elki-project.github.io/dev/dbids

    【讨论】:

      猜你喜欢
      • 2015-10-24
      • 2015-10-11
      • 2016-02-28
      • 1970-01-01
      • 1970-01-01
      • 2013-07-14
      • 1970-01-01
      • 2019-10-06
      • 1970-01-01
      相关资源
      最近更新 更多