検索に戻る
案件記録
基于大小模型协同的知识型视觉问答方法、设备及介质
発明有効
1閲覧数
10請求項 · 3 独立
§ Ⅰ
案件概要
発明者
胡若男; 赵成; 甄超; 葛健; 李奕萱; 娄伟; 朱胜龙; 田宇; 潘敏
IPC分類
G06F 16/3329 (2025.01)G06F 16/334 (2025.01)G06F 16/338 (2019.01)G06F 40/30 (2020.01)
基于大小模型协同的知识型视觉问答方法、设备及介质,属于视觉问答技术领域,解决如何提高视觉问答技术面临复杂问题的准确性的问题;本发明在图像描述提取步骤生成与自然语言问题高度关联的图像描述与关键对象标签集合,在实体增强处理步骤通过提取关键实体并生成用于消解语义歧义的澄清性问题和实体示例,在候选答案生成步骤基于多轮生成策略在不同推理维度下生成若干语义互补的答案,基于模型内置评分机制筛选优化后的候选答案,在上下文示例检索步骤通过检索与当前输入最相关的示例,最后,大语言模型接收上述步骤输出结果拼接形成的统一输入提示,以自回归方式推理生成答案,有效提高视觉问答技术面临复杂问题的准确性。
外部リソース