CNIPA.AI
검색으로 돌아가기
기록

一种机器人运动控制模型训练方法和机器人运动控制方法

발명유효
12청구항 · 7 독립항
§ Ⅰ

개요

발명자

郭宜劼; 韩刚

IPC 분류

G05B 13/04 (2006.01)

本发明公开了一种机器人运动控制模型训练方法,包括:基于当前时刻的训练机器人状态,利用待训练运动控制模型的策略网络进行决策,得到未来预设帧数的训练控制指令和训练隐变量,预设帧数大于1,训练隐变量为不可观测但对模型的决策和预测起作用的随机变量;基于训练隐变量,利用待训练运动控制模型的解码网络进行预测,得到未来预设时刻的机器人预测状态;利用仿真引擎依次执行预设帧数的训练控制指令,得到机器人实际状态;根据预设时刻的机器人预测状态和机器人实际状态,更新待训练运动控制模型的策略网络和解码网络的参数,得到训练好的运动控制模型。该模型对未来机器人状态的预测更接近实际机器人状态,从而提高对机器人控制的稳定性。