Diffusion Models视频生成-博客汇总

前言谷歌研究院联合英伟达提出了DreamPose,通过修改起点噪声融入姿态信息,并微调VAE-CLIP adapter注入图片信息,做到pose&imagetovideo效果。是少数扩散模型中imagetovideo的工作,这篇博客详细解读一下这篇论文《DreamPose: Fashion Image-to-Video Synthesis via Stable Diffusion》。

目录

贡献概述

方法详解

整体结构

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注