Back to Search
Dossier
基于微分博弈与强化学习的矩形区域无人机围捕方法
InventionActive
8Claims · 1 independent
§ Ⅰ
Dossier Overview
Inventor
杨晓君; 柯权文; 何兵; 席建祥; 顾鑫; 曾安; 陈辉
IPC Classification
G05D 1/46 (2024.01)G05D 1/695 (2024.01)G05D 109/20 (2024.01)
本发明公开了一种基于微分博弈与强化学习的矩形区域无人机围捕方法。由我方无人机集群获取环境状态信息;通过矩形飞行区域限制损失函数模块计算空间约束损失,并通过批量时序行为约束模块计算时序一致性损失,将二者结合生成融合空间与时序约束的状态行为联合隐变量。将该隐变量与当前环境状态融合,输入至微分博弈价值评价模块,通过求解我方与黑飞无人机之间的微分博弈,获取基于纳什均衡的未来期望价值,并以此更新决策网络参数。集群执行优化后的围捕动作,并将经验数据存储用于持续训练。本发明有效提升了在矩形有限飞行区域内无人机集群围捕的决策稳定性、协同效率与任务成功率。
External Resources