【发布时间】:2017-10-03 20:28:04
【问题描述】:
是否有任何无缝方式可以在 NV V100/P100 中实现最佳 fp16 性能? 例如。我有一个在 fp32 中训练的模型和实现。该应用程序完美运行。现在,我想探索一下fp16的体验。有什么简单的方法可以实现吗?
【问题讨论】:
-
我有非常相似的问题。我想采用经过训练的 fp32 模型并使用 fp16 运行推理。你有没有想过我们或任何想法如何做到这一点?
标签: tensorflow tensorflow-gpu tensorflow-xla