产品概述
VideoPoet 是 Google 研发的一款多模态视频生成工具,它不同于传统的扩散模型,而是基于大型语言模型(LLM)构建。你可以输入文本、图片甚至音频,让 AI 自动生成对应的视频内容,还支持视频风格化、局部修复、外绘画以及视频到音频的生成。简单来说,就是把多种视频创作能力打包进一个模型,像跟 AI 聊天一样快速出片。
核心优势
首先,VideoPoet 将文本、图像、音频多种输入统一在一个 LLM 框架里,不需要切换不同工具就能完成从创意到成片的全流程。它采用预训练加任务适配的两步训练法,基础大模型学到的通用知识可以灵活迁移到各类视频生成任务,效果更稳定。
其次,它能生成比大多数 AI 视频工具更长的视频——虽然首段只能生成 2 秒,但后续可以延续到 8-10 秒,并且保持画面上下文连贯。操作也极其简单,不需要任何技术背景,登录网站选好输入类型和风格,几分钟就能得到一段可编辑的精美视频,还能直接下载为 MP4 或分享到社交媒体。
适用场景
- **创意内容制作**:博主、短视频创作者快速生成素材或特效片段
- **教育演示**:将枯燥的文本转化为动态讲解视频,吸引学生注意力
- **营销推广**:品牌方根据产品描述生成广告短片或社交媒体动态
- **娱乐与艺术**:艺术家进行视频风格迁移、动画化或修复老素材
- **辅助视频编辑**:对现有视频进行局部修复、外绘画扩展或自动配音