Stable Video Diffusion

Stability AI 开发的图像生成视频模型,基于 Stable Diffusion 架构,能将静态图片转为流畅视频,提供 14 帧和 24 帧两种变体。

writing 🆓 免费 🔓 开源
✨ 基于 Stable Diffusion 的图像转视频✨ 提供 14 帧与 24 帧两种变体✨ 灵活的帧速率自定义✨ 开源模型可本地部署微调✨ 研究预览阶段,面向创意用途
🌐 访问官网 →

产品概述

Stable Video Diffusion 是 Stability AI 推出的视频生成模型,基于 Stable Diffusion 图像模型扩展而来。它接受一张图片作为输入,自动生成连贯的视频内容。目前提供两种变体:SVD 生成 14 帧、576x1024 分辨率的视频;SVD-XT 扩展至 24 帧,适合需要更长动态片段的场景。该模型仍处于研究预览阶段,主要面向教育、创意和实验性用途。

核心优势

**开箱即用的图像转视频**:无需额外训练或复杂流程,上传图片即可生成视频,极大降低了视频创作门槛。模型在大型精选视频数据集上预训练,具备良好的泛化能力,能处理多种风格和内容。 **灵活的帧率与变体选择**:用户可根据需求选择 SVD(14 帧)或 SVD-XT(24 帧),并支持自定义帧速率,适配不同的动态节奏和时长要求。 **开源可定制**:作为开源模型,开发者可以在本地部署并进一步微调,探索广告、教育、多视角合成等专业领域的应用。

适用场景