【问题标题】:How to handle simultaneous actions in Reinforcement Learning如何处理强化学习中的同时动作
【发布时间】:2020-08-14 14:18:51
【问题描述】:

我正在尝试使用强化学习来解决一个涉及大量同时动作的问题。例如,代理将能够采取可能导致单个动作的动作,例如射击,或者可能导致多个动作的动作,例如射击同时跳跃、右转同时做空手道斩等。当所有可能的动作结合起来,我最终得到了一个巨大的动作数组,比如 1 x 2000。所以我的 LSTM 网络输出数组将具有这个大小。当然,我将使用字典来解码动作数组以应用动作。所以我的问题是,动作数组是否太大?这是处理同时动作的方式吗?有没有其他方法可以做到这一点?随意链接您看到的任何具体示例。谢谢。

【问题讨论】:

    标签: reinforcement-learning


    【解决方案1】:

    【讨论】:

    • 非常感谢,OpenAi 的工作arxiv.org/pdf/1912.06680.pdf 也很有用,但他们没有详细说明如何处理同时操作。解决此问题的一种方法是将时间步骤细分为更精细的步骤,其中子步骤的数量等于可能可用的同时操作的数量。唯一的工作是您在自己的环境中工作,而不是在 Gym 中工作。
    猜你喜欢
    • 2021-12-20
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-10-22
    • 2013-12-06
    • 1970-01-01
    相关资源
    最近更新 更多