検索に戻る
案件記録

一种RRT引导的空间机械臂强化学习路径优化控制方法

発明有効
1閲覧数
10請求項 · 1 独立
§ Ⅰ

案件概要

発明者

夏博; 王学谦; 陈雷; 刘甘霖; 张可; 于明焕; 张海丽

IPC分類

B25J 9/16 (2006.01)G06N 7/01 (2023.01)G06N 20/00 (2019.01)

本发明提出一种RRT引导的空间机械臂强化学习路径优化控制方法,属于机械臂控制技术领域。本发明在关节空间中利用RRT算法生成无碰撞初始路径,在此基础上将空间机械臂‑基座系统建模为马尔可夫决策过程,通过相邻路径点构造局部强化学习训练任务,进而沿路径执行并构建经验回放池,采用演员‑评论家架构在全局尺度上对从起点到目标点的策略进行再优化。本发明用于实现路径规划与动作控制的一体化智能优化。

外部リソース