【发布时间】:2020-01-11 11:33:36
【问题描述】:
我正在 Jupyter-Lab 笔记本上训练 PyTorch 深度学习模型,使用 Tesla K80 GPU 上的 CUDA 进行训练。在进行训练迭代时,使用了 12 GB 的 GPU 内存。我通过保存模型检查点来完成训练,但想继续使用笔记本进行进一步分析(分析中间结果等)。
但是,这些 12 GB 在完成训练后继续被占用(从 nvtop 可以看出)。我想释放这个内存,以便我可以将它用于其他笔记本。
到目前为止,我的解决方案是重新启动此笔记本的内核,但这并不能解决我的问题,因为我无法继续使用同一个笔记本及其各自的输出。
【问题讨论】: