【发布时间】:2018-04-23 16:30:21
【问题描述】:
我目前正在开发一个深度强化学习网络,但是,我对 NN 输出的 q 值的数量有一点疑问。我总共将有 150 个 q 值,这对我个人来说似乎过多。我已经阅读了几篇论文和书籍,这可能是一个问题。我知道这将取决于我将构建的 NN 类型,但是你们是否认为 q 值的数量太高了?我应该减少它吗?
【问题讨论】:
-
什么是“Q值的数量”?你的意思是你有 150 个动作要采取,因此对于每个状态 s 有 150 个 Q(a, s) 需要估计?
-
是的,就是这样
标签: neural-network deep-learning reinforcement-learning q-learning