검색으로 돌아가기
기록
基于大小语言模型协同的格式化知识推理方法及系统
발명유효
10청구항 · 2 독립항
§ Ⅰ
개요
발명자
王钰; 李艺琦; 廖育生; 陈哲; 王延峰
IPC 분류
G06N 5/04 (2023.01)G06N 5/022 (2023.01)G06N 3/09 (2023.01)
本发明提供了一种基于大小语言模型协同的格式化知识推理方法及系统,包括:对于任意大语言模型,在原始推理任务上生成自然语言形式的基础回答;通过小语言模型,使用迭代的方法根据推理问题和基础回答生成正确的推理路径;根据特定的格式指令,将推理问题、基础回答、推理步骤和标准答案重构为新型推理数据集;然后对任意开源小语言模型进行一次训练;构建奖励函数对一次训练后小语言模型的输出进行评分,根据评分进行二次训练,削弱原始训练目标中次要因素对训练结果的影响。本发明显著提升了小语言模型对大语言模型知识利用的准确率,增强了对用户指令要求的遵循能力,从而实现了语言模型在复杂推理和遵循用户指令上的高性能。