検索に戻る
案件記録
基于多模态大语言模型的封面图生成方法、装置和设备
発明有効
15請求項 · 5 独立
§ Ⅰ
案件概要
発明者
谢强; 李涛; 吴宗刚
IPC分類
G06T 11/60 (2026.01)G06F 16/9538 (2019.01)G06F 16/9535 (2019.01)G06N 3/045 (2023.01)G06N 3/0475 (2023.01)G06N 3/092 (2023.01)
本公开提供了一种基于多模态大语言模型的封面图生成方法、装置、设备、介质和产品,涉及人工智能技术领域,尤其涉及计算机视觉、深度学习、大模型等技术领域,能够用于基于AIGC的内容生成、生成式搜索、文档智能编辑、智能助手、虚拟助手、智能电商、智能推荐等应用场景。基于多模态大语言模型的封面图生成方法包括:基于目标内容的内容特征,在所述目标内容包括的候选图像中确定封面底图;基于所述目标内容包括的原始文本,获取封面文本;采用多模态大语言模型,对所述封面底图和所述封面文本进行融合,以获得候选封面图;在所述候选封面图中确定目标封面图。
外部リソース