【发布时间】:2016-03-06 21:20:53
【问题描述】:
我正在尝试调试一个有些复杂且非规范的 NN 架构。计算前向传递很好,并且给了我预期的结果,但是当我尝试使用 Adam 或任何标准优化器进行优化时,即使在一次迭代后学习率非常低,我到处都会得到 nans。我正在尝试对它们进行本地化,并且想知道是否有办法捕获第一次出现的 nan 并检测它出现在哪个操作中?我尝试了tf.add_check_numerics_ops(),但它似乎没有做任何事情,或者我使用不正确。
【问题讨论】:
-
你能在哪里解决这个问题?我也有同样的问题
标签: tensorflow