CNIPA.AI
검색으로 돌아가기
기록

一种基于扩散模型的pose驱动的可控视频生成方法

발명유효
8청구항 · 1 독립항
§ Ⅰ

개요

IPC 분류

H04N 21/854 (2011.01)H04N 21/44 (2011.01)G06V 40/20 (2022.01)G06V 20/40 (2022.01)G06V 10/62 (2022.01)G06V 10/75 (2022.01)

本发明公开了一种基于扩散模型的pose驱动的可控视频生成方法,包括如下步骤:获取参考外观图像集与姿态序列,生成观测张量并建立骨架模板;调用可微SoftPOSIT,得到软分配矩阵、帧级位姿初始结果、可见性权重与匹配置信度;交替更新并施加骨长不变、关节限幅、运动链一致性约束,输出帧级位姿估计;按匹配置信度组织初始姿态序列,生成可见性权重序列与软分配矩阵序列;建立跨帧因子图,输出时间一致姿态序列并生成因子图状态;整合前述量为视频条件序列;扩散去噪中同步调整匹配温度参数与噪声强度,计算姿态一致引导并增量更新因子图状态;依据姿态一致引导生成视频帧序列。本发明提升姿态一致性与时序稳定并增强可控性。