breakout-v0的action_space有4个动作,分别是0-NOOP,1-FIRE,2-RIGHT,3-LEFT。之前一直以为环境默认发出小球供击打,其实发出小球需要智能体做出动作1-FIRE。而我的模型没有学会在一小轮失败后做出动作1,故一直环境停滞不前。
DQN算法训练atari游戏breakout,训练越往后越慢,游戏停滞不前
最新推荐文章于 2026-08-10 08:51:36 发布
在Atari游戏breakout-v0中,智能体的action_space包括4个动作。重要的是,要启动游戏并发射小球,必须执行动作1-FIRE。然而,作者遇到的问题是其训练的模型在经历失败后未能学习到执行此动作,导致游戏无法进展。这需要对模型进行调整,使其能正确响应游戏状态并适时发射小球。

5115

被折叠的 条评论
为什么被折叠?



