검색으로 돌아가기
기록
面向复杂动态博弈场景的大语言模型智能体协同决策方法
발명유효
10청구항 · 3 독립항
§ Ⅰ
개요
발명자
顾晶晶; 段仕伟; 王秋红
IPC 분류
G06N 3/006 (2023.01)G06F 18/25 (2023.01)G06F 18/22 (2023.01)G06F 18/23213 (2023.01)G06N 3/0455 (2023.01)G06N 3/0442 (2023.01)G06N 3/092 (2023.01)G06N 5/02 (2023.01)G06N 5/04 (2023.01)
本发明公开了一种面向复杂动态博弈场景的大语言模型智能体协同决策方法,包括:实现环境感知、经验积累与知识调取功能,支撑智能体的认知建模与策略生成;基于认知信息,通过动作表征器和角色选择器实现智能体角色划分与分工,指导智能体协同过程中各司其职。将认知信息与角色信息输入大语言模型,依托其自然语言理解与思维链推理能力,对博弈局势进行分层分析,识别关键博弈节点,预测对手策略并结合队友意图生成前瞻性协同决策。通过语义匹配与动作映射机制,将推理生成的自然语言决策转化为结构化可执行指令,并进行合理性校验。智能体执行动作并与环境交互,系统基于反馈更新短期记忆并周期性整合为长期记忆,形成“认知—角色分配—推理—执行—更新”的闭环流程。本发明方法构建了基于大语言模型的分布式协同决策架构,使智能体具备更强的自主感知、推理与协同能力,显著提升了智能体在复杂动态博弈环境下的协作效率、博弈适应性与策略泛化方面的能力。