10.16526/j.cnki.11-4762/tp.2015.11.043
基于概率轨迹匹配的机器人模仿学习方法
模仿学习是机器人仿生机制研究的主要内容之一,即通过观察、理解、学习、模仿示教行为实现机器人的仿生特性;基于高斯过程分别表达采集离散示教信号所构成的示教轨迹和含有未知参数策略的模仿轨迹,构建模仿学习方法框架,将概率模型匹配引入到模仿学习中,以KL散度为代价函数比较两种轨迹的概率分布,运用梯度下降法寻求使KL散度最小的最优模仿控制策略,将策略应用于模仿机器人以完成与示教相同的模仿任务;以关节型机器人的机械臂摆动行为模仿为学习任务进行仿真,结果表明基于概率轨迹匹配的模仿学习方法能够实现机械臂摆动行为模仿,学习过程较传统方法简易且学习效果较好.
模仿学习、概率模型、轨迹匹配、高斯过程、控制策略
23
TP181(自动化基础理论)
国家自然科学基金项目61375086;国家自然科学基金项目61075110;高等学校博士学科点专项科研基金资助课题20101103110007
2015-12-09(万方平台首次上网日期,不代表论文的发表时间)
共5页
3713-3716,3720