CNIPA.AI
검색으로 돌아가기
기록

一种无人艇协同围捕控制方法

발명유효
2조회수
6청구항 · 1 독립항
§ Ⅰ

개요

발명자

李繁飙; 何志远; 尹蒙蒙; 赵逸云; 桂卫华; 周灿

IPC 분류

G05D 1/43 (2024.01)G05D 109/30 (2024.01)

本公开实施例中提供了一种无人艇协同围捕控制方法,属于控制技术领域,具体包括:为每艘追捕无人艇分配一个主围捕目标;对于每一艘追捕无人艇,根据其被分配的主围捕目标,形成包含变长交互序列的原始观测向量;通过双级注意力机制将原始观测向量中的变长交互序列转换为一个固定维度的标准化状态向量;将标准化状态向量输入至该无人艇的策略网络,输出连续的动作控制指令;基于执行动作控制指令后获得的经验数据,计算即时奖励,据此基于多智能体深度确定性策略梯度框架,采用中心化训练与去中心化执行的方式,对策略神经网络及对应的价值神经网络进行迭代更新,得到控制模型生成协同控制方案。通过本公开的方案,提高了控制精准度和适应性。