返回搜索
档案
一种大模型与强化学习结合的分层指挥控制方法
发明专利有效
1浏览
7权利要求 · 1 独立
§ Ⅰ
卷宗概要
发明人
焦文明; 徐莹辉; 徐亮; 王漱石; 王翘楚
IPC 分类
G05D 1/46 (2024.01)G05D 1/695 (2024.01)G05D 109/20 (2024.01)
本发明提供了一种大模型与强化学习结合的分层指挥控制方法,基于分层结构的智能体,一层智能体为基于RAG的大模型智能编队指挥智能体;二层智能体由空中打击编组、察打混合编组智能体组成;二层智能体通过一层智能体发送的指令判断执行哪个子任务;包括以下步骤:S1、基于RAG的大模型智能编队指挥系统,包括离线知识准备阶段和在线决策执行阶段;S2、设定状态空间、动作空间、奖惩函数;S3、对空中打击编组、察打混合编组智能体进行分别训练,基于多智能体强化学习算法构建智能博弈模型。本发明通过RAG技术为大模型提供专属知识支撑,再通过大模型生成结构化决策指令,同时依托多智能体强化学习进行训练得到具体任务的智能体,实现编队级的指挥控制。