【发布时间】:2018-12-13 23:25:19
【问题描述】:
我正在为 SQUAD(斯坦福问答)数据集 (https://rajpurkar.github.io/SQuAD-explorer) 构建模型。斯坦福没有发布它的测试集。它只为我们提供训练和开发数据集。
这是我的问题:
当我调整不同模型的超参数时,我根据斯坦福大学提供的“开发”数据调整它们。但是,我们将“开发”集视为“测试”集,因为我们无法访问真正的“测试”数据。我们根据“dev”数据集上的性能,在不同的模型中只选择 1 个模型提交。
所以我想知道是否应该将训练集进一步分为训练集和开发集,并在新分离的开发集上调整超参数,而不是斯坦福给出的开发集,因为我们使用“开发”集作为“测试”集。 我有没有作弊?我是否需要从现有的火车数据中创建另一个“开发”数据,进一步拆分它,并在那里调整超参数,并检查给定“开发”集的性能数?
【问题讨论】:
标签: machine-learning hyperparameters