【发布时间】:2016-11-04 14:07:39
【问题描述】:
我有一个 DCNN,在经过几个 epoch 的训练后出现了分歧,但最初取得了不错的效果。返回一个纪元或纪元的一小部分,降低学习率并继续,是否“安全”,或者我应该假设某些权重可能接近病态,因此有必要完全重新开始训练(使用降低学习率)?
一个相关的问题是网络内部的什么样的行为会产生这样的结果。我认为发散应该在训练的早期发生,而不是在网络似乎已经接近完全收敛的时候。
【问题讨论】:
标签: neural-network deep-learning caffe conv-neural-network backpropagation