机器人

北大核心,JST,EI,CSCD,WJCI

国内刊号:21-1137/TP

国际刊号:1002-0446

机器人杂志2019年第6期:基于AM-RPPO的双足机器人适应性行走控制算法

发布日期:

作者:马璐, 刘成菊, 林立民, 徐斌辰, 陈启军

关键词:深度强化学习, 循环神经网络, 注意力机制, 自适应双足行走

提出了一种带有注意力机制和循环近端策略优化(AM-RPPO)的深度强化学习(DRL)方法并将其应用于双足机器人的适应性行走控制.首先,对未知环境下双足机器人关节空间行走控制问题依照部分可观测马尔可夫决策过程(POMDP)进行建模,指出了DRL算法近端策略优化(PPO)对真实状态的估计存在偏差的问题.其次,引入循环神经网络(RNN)架构,分析了RNN对时序环境观测状态不同于多层感知机的正向传播过程,说明了RNN相对于传统神经网络的优势,并且将RNN分别嵌入动作生成网络和价值函数生成网络中.再次,引入在深度学习诸多领域应用广泛的注意力机制(AM),利用AM建立基于不同时间步的状态,求得最终价值函数的权重差异化模型.最后,通过仿真实验验证了提出的AM-RPPO算法对存在高维状态信息输入的双足机器人控制问题的有效性.

来源:2019年第6期

《机器人》期刊编辑部

查看机器人杂志2019年第6期

声明

严正声明:本站非期刊官网,非中介代理。

本站仅提供学术规范服务:快速预审、润色编辑服务、中英文查重、降重、去重服务、推荐合适的期刊投稿等学术规范服务。 如需提供学术规范服务请联系在线编辑。

联系我们

  • 地址:沈阳市浑南区创新路135号
  • 电话:024-23970050
  • E-mail:jqr@sia.cn

咨询工作人员