CNIPA.AI
검색으로 돌아가기
기록

基于初始噪声优化与注意力引导的物体数量可控的图像生成方法

발명유효
1조회수
6청구항 · 1 독립항
§ Ⅰ

개요

발명자

顾晓玲; 吴圣琪; 李学龙; 杨铭烁; 徐宜航; 高健

IPC 분류

G06T 11/60 (2026.01)G06T 5/70 (2024.01)G06T 5/60 (2024.01)G06N 3/045 (2023.01)

本发明公开了基于初始噪声优化与注意力引导的物体数量可控的图像生成方法,该方法首先根据文本提示,针对扩散模型生成的交叉注意力图进行物体区域规划,利用并改变初始噪声的布局偏好与用户指定的目标物体数量K对齐。其次根据规划出的K个物体区域,对初始噪声的潜在表示进行调整。最后基于调整后的潜在表示进行去噪,引入测试时优化目标,在去噪过程中动态计算并优化该损失,最终得到生成图像。本发明避免了对已形成语义内容的破坏,因此在大幅提升计数精度的同时,能有效保持生成图像的整体视觉质量和语义一致性。