【发布时间】:2015-09-29 02:00:09
【问题描述】:
假设我们有一个匿名数据的大型数据集。数据集由一定数量的变量和观察组成。我们所能了解的所有数据都是变量的类型(数字、字符、日期等)。我们可以通过手动查看数据来做到这一点。 预处理数据集以进行进一步分析的最佳实践步骤是什么?
例如,让这个数据集只是一个表,所以我们不需要检查表之间的任何关系。
【问题讨论】:
标签: data-mining
假设我们有一个匿名数据的大型数据集。数据集由一定数量的变量和观察组成。我们所能了解的所有数据都是变量的类型(数字、字符、日期等)。我们可以通过手动查看数据来做到这一点。 预处理数据集以进行进一步分析的最佳实践步骤是什么?
例如,让这个数据集只是一个表,所以我们不需要检查表之间的任何关系。
【问题讨论】:
标签: data-mining
This link 提供了当前实践中的完整验证集。不过,首先:
希望这足以让你开始......
【讨论】: