検索に戻る
案件記録

一种多机器人追逃博弈的追捕策略生成方法、装置及设备

発明有効
10請求項 · 4 独立
§ Ⅰ

案件概要

発明者

朱圆恒; 陆润宇; 石若川; 赵冬斌

IPC分類

G05D 1/43 (2024.01)G05D 1/246 (2024.01)G05D 1/633 (2024.01)G05D 1/644 (2024.01)G05D 109/10 (2024.01)

本发明涉及追逃博弈技术领域,公开了一种多机器人追逃博弈的追捕策略生成方法、装置及设备,方法包括:基于训练地图的类型,计算训练地图中所有追捕机器人的追捕策略和逃逸机器人的逃逸策略;基于所有训练地图中的追捕策略和逃逸策略,训练初始策略模型,得到目标策略模型;对于目标地图,采用目标策略模型生成目标地图中所有追捕机器人的目标追捕策略。本发明通过针对不同类型的训练地图,分别生成追逃双方的策略,并基于此训练模型,使模型学习不同地图结构下的策略特征,突破地图结构单一、逃逸策略简化的限制,具备零样本泛化能力,将训练好的模型应用于未知的目标地图,能够快速生成适配的追捕策略,满足复杂环境的实战需求。

外部リソース