【问题标题】:Stablebaselines MultiInputpolicies稳定的基线多输入策略
【发布时间】:2021-06-22 23:09:11
【问题描述】:

我尝试通过以下方式使用 MultiInputPolicy:

model = PPO("MultiInputPolicy", env, verbose = 1)

但是,我得到一个错误:

KeyError: "Error: unknown policy type MultiInputPolicy,the only registed policy type are: ['MlpPolicy', 'CnnPolicy']!"

请帮忙。我该如何解决这个问题?

【问题讨论】:

    标签: openai-gym stable-baselines


    【解决方案1】:

    您似乎安装了旧版本的stable-baselines3。如果您已安装使用

    pip install stable-baselines3
    

    ,它可能不是 master 分支的最新版本。从最新的主分支安装:

    pip install git+https://github.com/DLR-RM/stable-baselines3.git
    

    对于pipenv,您可能必须指定egg

    pipenv install git+https://github.com/DLR-RM/stable-baselines3.git#egg=stable_baselines3
    

    MultiInputPolicyadded on 5 月 11 日。最新的 pypi 版本is of 3 月 17 日。

    【讨论】:

    • @Mahesa999 这适用于 FetchReach-v1 健身房环境吗?
    • 错误是关于稳定的基线,它独立于任何特定的健身房。所以,是的,它会起作用,因为错误和指定的健身房环境之间没有联系。
    • 我创建了一个 CustomPPO 类和一个 CustomActorCrticClass。但是当我调用 model.learn 时,它们都有不同的观察结果。这会导致错误。你能帮忙吗?
    • 也许你可以在 stackoverflow 上发布一个新问题。还有一项建议,您可以在reinforcement learning subreddit 上提问。它非常活跃,sb3 开发人员确实在那里回复。他们也有discord server。如果以上答案解决了您提出的问题,请不要忘记将其标记为答案。
    猜你喜欢
    • 2022-01-26
    • 2021-07-06
    • 1970-01-01
    • 2022-12-17
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2021-10-14
    • 2011-01-24
    相关资源
    最近更新 更多