DOI：10.12052/gdutxb.180044

未知环境下基于虚拟子目标的对立Q学习机器人路径规划

引用

摘要：

针对Q学习算法在复杂的未知环境下Q值更新速度慢,容易产生维数灾难等问题,提出了一种未知环境下基于虚拟子目标的对立Q学习机器人路径规划算法.该算法根据移动机器人探索过的状态轨迹,建立了2个状态链分别记录状态-动作对和状态-反向动作对,并将每个单链当前状态的Q值,依次反馈影响前一状态的Q值,直到状态链的头端.同时,在局部探测域内通过寻找最优虚拟子目标的方法解决了大规模环境下Q学习容易产生维数灾难的问题.实验结果表明,在复杂的未知环境中,该算法可以有效地加快算法学习的收敛速度,提高学习效率,以较优的路径完成机器人导航任务.

关键词：移动机器人、虚拟子目标、对立Q学习、未知环境

所属期刊栏目：36

分类号：TP242.6(自动化技术及设备)

资助基金：广东省产学研合作专项项目2014B090904080;广东省应用型科技研发专项项目2015B090922012;东莞市产学研合作项目2015509109107

在线出版日期：2019-03-08（万方平台首次上网日期，不代表论文的发表时间）

页数：共7页

页码：51-56,62

英文信息展示

期刊专题