基于历史回报引导探索策略的机器人智能博弈对抗研究
万方数据知识服务平台
应用市场
我的应用
会员HOT
万方期刊
×

点击收藏,不怕下次找不到~

@万方数据
会员HOT

期刊专题

10.19949/j.ams.mora.20220707.01

基于历史回报引导探索策略的机器人智能博弈对抗研究

引用
针对作战机器人在异构对称场景下战场环境探索不充分、不优化的问题,提出一种基于历史回报引导深度强化学习的探索策略,将元参数学习的思想应用于深度强化学习中超参数的学习,引导智能体进行探索.研究历史回报与探索策略之间的关系,提出在线学习的探索策略构建方法;将提出的基于历史回报引导探索策略应用于作战机器人博弈对抗任务中,辅助深度强化学习决策模型快速生成博弈对抗策略,优化了作战机器人在实时异构对称场景中的博弈策略.

异构对称、智能博弈对抗、深度强化学习、历史回报、探索策略

38

E911;TP319(军事技术基础科学)

2023-07-04(万方平台首次上网日期,不代表论文的发表时间)

共5页

42-46

相关文献
评论
暂无封面信息
查看本期封面目录

军事运筹与评估

2097-1702

10-1850/E

38

2023,38(2)

相关作者
相关机构

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn