CNIPA.AI
검색으로 돌아가기
기록

一种基于步态规划与强化学习的人形机器人运动控制方法

발명유효
1조회수
10청구항 · 1 독립항
§ Ⅰ

개요

발명자

吴立刚; 胡启航; 邵翔宇; 孙光辉; 高亚斌; 姚蔚然

IPC 분류

G06N 3/008 (2023.01)B25J 9/16 (2006.01)B25J 9/00 (2006.01)G06N 3/092 (2023.01)G06N 3/084 (2023.01)

一种基于步态规划与强化学习的人形机器人运动控制方法,它属于人形机器人运动控制技术领域。本发明解决了现有强化学习方法的训练过程收敛速度慢,训练好的模型的稳定性以及可靠性差的问题。本发明使强化学习模型在多环境实例下并行运行,在运行过程中,基于反馈的状态信息来实时生成目标落脚点,将生成的参考落脚点与质心轨迹作为控制器的动作参考或奖励目标,并结合步态相位信息构建连续且动态调整的足端轨迹。利用收集的全部轨迹数据对强化学习模型进行训练后,通过训练好的强化学习模型可以对人形机器人进行运动控制,使机器人在不依赖预定义模板的情况下实现类似人类的稳定行走。本发明方法可以应用于人形机器人运动控制。