把 Stable Video Diffusion 图生视频模型的 init_image 条件替换为文本嵌入与条件帧的节点。条件帧是一组潜空间。
https://github.com/SpaceKendo/ComfyUI-svd_txt2vid
git clone https://github.com/SpaceKendo/ComfyUI-svd_txt2vid
comfy node install ComfyUI-svd_txt2vid
CogVideoX 模型的 diffusers 封装。
从任意视频和/或文本生成音频。
自动基准测试并优化扩散模型中的注意力。RTX 4090 上 1.5-2 倍提速,视频模型最高 4 倍。
支持起止帧视频生成的节点。
By Author