【发布时间】:2020-02-03 00:21:05
【问题描述】:
对于我的第一个强化学习项目,我正在尝试训练代理玩实时游戏。这意味着环境会不断地移动并做出改变,因此代理需要精确地了解其时间。为了有一个正确的顺序,我认为代理必须以一定的频率工作。我的意思是,如果代理的频率为 10Hz,它必须每 0.1 秒接受一次输入并做出决定。但是,我找不到有关此问题/事项的任何来源,但这可能是由于在我的搜索中未使用正确的术语。这是处理此事的有效方法吗?如果是这样,我可以使用什么?我在windows中使用python3(游戏只在windows中运行),有没有可以使用的库?我猜time.sleep() 不是一个可行的出路,因为它不是很精确(在使用高频时),而且它只会冻结代理。
编辑:所以我的主要问题是:
a) 我应该使用某个频率,这是操作强化学习代理的正常方式吗?
b) 如果是,您建议使用哪些库?
【问题讨论】:
标签: python python-3.x time reinforcement-learning