DQN算法训练atari游戏breakout,训练越往后越慢,游戏停滞不前

在Atari游戏breakout-v0中,智能体的action_space包括4个动作。重要的是,要启动游戏并发射小球,必须执行动作1-FIRE。然而,作者遇到的问题是其训练的模型在经历失败后未能学习到执行此动作,导致游戏无法进展。这需要对模型进行调整,使其能正确响应游戏状态并适时发射小球。

breakout-v0的action_space有4个动作,分别是0-NOOP,1-FIRE,2-RIGHT,3-LEFT。之前一直以为环境默认发出小球供击打,其实发出小球需要智能体做出动作1-FIRE。而我的模型没有学会在一小轮失败后做出动作1,故一直环境停滞不前。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值