数智技能研修平台
AI 前沿发现
Civitai
LTX 2.3 GTAnimation 高速版:5秒25帧,12G显存流畅运行
Wan2.1-VACE是面向视频创作与编辑的多模态生成模型,结合CausVid加速器实现9帧/秒快速生成。支持参考到视频、视频编辑、遮罩编辑等任务,在ComfyUI中高效部署。适合快速原型制作、视频后处理及教育培训素材生产。
查看原文 →内容为平台聚合整理,原文与最新动态以来源页面为准。
加微信 · 获取使用指导与更多资源
节点安装、依赖模型、下载问题均可咨询;群内持续更新精选资源。
扫码进资源群
扫码加客服微信图文介绍
项目/模型定位
WAN-VACE 是面向视频创作与编辑的一体化生成模型,结合 CausVid 加速器,在 ComfyUI 环境中实现高效、可控的视频内容生产。该模型并非单纯的文本转视频(T2V),而是基于参考图像或视频的多模态生成工具,可视为视频领域的 ControlNet。CausVid 采用扩散模型指导自回归(逐帧)系统,使高质量视频生成速度达到 9 帧/秒,尤其适合需要快速迭代创意的工作流。
核心功能亮点
- 多任务统一:支持参考到视频(R2V)、视频到视频编辑(V2V)、遮罩区域视频编辑(MV2V),可自由组合,实现“移动任何对象”“替换任何元素”“引用任何内容”等复杂操作。
- 加速技术:CausVid 提供 4–8 步加速生成,基于 MIT 团队的混合 AI 模型架构,在普通消费级显卡上即可流畅运行。
- 灵活适配:兼容 Wan2.1 系列(1.3B / 14B 两种规模,480P / 720P 分辨率),并通过权重提取与分离提供通用 CausVid LoRA(rank32),支持 FT 模型和 I2V 模型。
- 便捷部署:提供原生 ComfyUI 节点支持,工作流内置于示例文件中,可直接拖拽使用。
适用场景
- 快速视频原型制作:从参考图像或视频生成一致性的动画效果,适合数字媒体、广告、游戏开发。
- 视频后处理与局部编辑:替换或移动画面内物体,扩展场景边界,无需逐帧手动调整。
- 教育培训素材生产:为非专业创作者提供低门槛的视频生成与编辑能力,用于演示、案例制作等。
上手提示
- 硬件要求:建议 GPU 显存 ≥22GB 以完全加载模型并高速生成;显存 12GB 以上可通过权重交换方式运行。
- 环境准备:在 ComfyUI 中安装 Kijai 的 WanVideoWrapper(推荐),并确保已加载 Wan2.1-VACE 基础模型(FP8 或 INT8-INT4 优化版)。
- 工作流获取:示例 Workflow 附在模型下载包的 Training data 压缩包内,亦可将官方提供的示例视频直接拖入 ComfyUI 自动提取。
- LoRA 微调:约 75% 的 Wan1.2 系列 LoRA 权重可迁移至 VACE,若效果不明显可尝试将 LoRA 权重提高至 100% 以上。
作者/来源:AiMetatron
常见问题
Wan2.1-VACE模型对显存有什么要求?
建议GPU显存不低于22GB以完全加载模型并高速生成。显存12GB以上可通过权重交换方式运行,性能会有所降低。
CausVid加速器能提升多少生成速度?
CausVid采用扩散模型指导自回归系统,使用4–8步加速生成,在普通消费级显卡上可实现约9帧/秒的视频生成速度。
Wan2.1-VACE支持哪些视频编辑功能?
支持参考到视频(R2V)、视频到视频编辑(V2V)、遮罩区域视频编辑(MV2V),可自由组合实现移动对象、替换元素、引用内容等操作。
如何在ComfyUI中部署Wan2.1-VACE?
需要先安装Kijai的WanVideoWrapper,并加载Wan2.1-VACE基础模型(FP8或INT8-INT4优化版)。示例工作流附在模型下载包中,也可直接拖拽官方示例视频自动提取。