【问题标题】:KNIME comparing datasetsKNIME 比较数据集
【发布时间】:2019-05-07 03:12:29
【问题描述】:

您能否回答:- 因为我们使用 KNIME 来按照我们的要求运行我们的。在我们的工作流程中,我们比较了 2 个数据库中的客户数据,一个 oracle 和一个 Hive,然后我们想要报告有多少数据匹配,多少不匹配。所以现在我们想根据客户的位置对一些客户 ID 进行分组,以查看我们从哪个位置获得更多不匹配。你能告诉我我应该使用哪些节点来获取这种类型的自定义报告

【问题讨论】:

    标签: knime


    【解决方案1】:

    目前还不清楚你想如何进行比较,但我认为你需要Joiner 节点。之后,您可以使用 GroupBy 节点使用 GroupBy 节点按位置计算不匹配,但在此之前,您应该使用例如 Rule Engine 节点来转换由 Joiner创建的缺失值> 到一个值(如果原始数据集在感兴趣的列中缺少值,您应该在 Joiner 之前将它们更改)和所有其他值到一个不同的值。

    【讨论】:

    • 谢谢 Gabor,这对理解比较机制很有帮助,但是为了替换缺失值,我们在 KNIME 中确实有“缺失值节点”,你能告诉我这两个节点是否用于不同的目的.
    • Rule Engine 可以做更复杂的替换,但是如果你只需要替换缺失值,我同意缺失值节点是一个更干净的选择。
    猜你喜欢
    • 1970-01-01
    • 2011-07-30
    • 1970-01-01
    • 2012-02-10
    • 2015-07-10
    • 2014-08-30
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多