Vidu

国内首个达到Sora级别的视频大模型,融合Diffusion与Transformer,可一键生成16秒1080P高清视频,支持多镜头与高时空一致性。

video 🎁 分层付费
✨ 全球首创U-ViT架构✨ 首款Sora级别国产视频模型✨ 16秒1080P高清视频生成✨ 支持多镜头与时空一致性✨ 文本/图像/3D多模态输入
🌐 访问官网 →

产品概述

Vidu是由生数科技与清华大学联合开发的前沿视频大模型,采用全球首创的U-ViT架构,融合了Diffusion与Transformer技术。它能够一键生成长达16秒、分辨率高达1080P的高清视频内容,不仅精准模拟真实物理世界,还具备丰富的想象力和创作力,支持多镜头生成以及高时空一致性,是国内首个达到Sora级别的视频生成模型。

核心优势

Vidu的核心优势在于其创新的U-ViT架构,这一架构首次将扩散模型与Transformer深度融合,实现了大规模可扩展性。模型在真实物理模拟和想象力之间取得了平衡,无论是逼真的海浪、船只,还是充满创意的动画场景,都能高质量呈现。此外,Vidu还支持文本、图像、3D等多种模态输入,能够生成个性化的3D模型,并具备图像生成和API调用能力,为开发者和创作者提供灵活的工具链。 团队方面,生数科技汇聚了来自清华大学人工智能研究院以及阿里、腾讯、字节等顶级科技公司的顶尖人才,在深度生成式算法领域拥有底层创新能力,确保模型持续迭代。

适用场景