【发布时间】:2020-04-18 06:46:27
【问题描述】:
要在崩溃后恢复训练,不仅必须恢复模型,还必须恢复进入model.fit(...) 进程状态的所有对象和参数。
在我费心 fork keras 代码来实现 fitting 对象之前,我想知道恢复崩溃恢复的标准方法(如果有的话)是什么TensorFlow 2.0 训练从哪里停下来。
或者有人真的填补了 TensorFlow 对象模型中这个明显的漏洞?
【问题讨论】:
标签: tensorflow2.0 checkpointing