产品概述
VIMI大模型是商汤科技基于日日新大模型技术研发的全球首个可控人物视频生成AIGC产品。用户只需上传一张或多张人物照片,即可通过动作视频、动画、语音、文字等多种方式驱动照片中的人物,生成与目标动作高度一致、画质稳定不衰减的分钟级单镜头人物视频。该模型在2024年世界人工智能大会(WAIC)上发布并荣获“镇馆之宝”称号。
核心优势
VIMI最突出的特点是**超强的人物可控性**。它不仅能精准控制面部表情(如微笑、眨眼),还能自然驱动上半身肢体动作,甚至自动补全合理的头发、服饰及背景变化,连光影效果都能随动生——这让生成的视频看起来和谐唯美,摆脱了早期AI视频的“鬼畜”感。
另一个关键突破是**长视频稳定性**。传统AI视频生成往往几秒后画面就开始模糊、抖动或失真,而VIMI能稳定生成长达一分钟的单镜头人物视频,且画面品质不随时间劣化。同时支持多种控制输入(视频、动画参数、语音、文字),让创作方式更灵活。
适用场景
- **娱乐创作**:用户可快速生成数字分身、写真短片或趣味表情包,适合社交分享和个性化表达。
- **聊天互动**:支持带人物出镜的聊天、唱歌、舞动等实时互动场景,让虚拟角色更生动。
- **影视与动画制作**:为影视作品提供高质量可控人物素材,降低拍摄成本;动画师可借助骨架驱动提高制作效率。