MagicAvatar

字节跳动推出的多模态虚拟人生成工具,通过文本、视频、音频输入创建并动画化虚拟人物,支持个性化定制。

video 🆓 免费
✨ 多模态输入生成虚拟人物✨ 两阶段运动与视频分离生成✨ 文本/视频引导化身动画✨ 上传照片实现个性化定制✨ 未来支持音频驱动虚拟人
🌐 访问官网 →

产品概述

MagicAvatar是字节跳动开发的一款多模态虚拟人生成与动画框架。它能够将文本描述、视频素材或音频信号转化为动作信号,从而驱动虚拟人物的生成和动画。与直接生成视频的方式不同,MagicAvatar采用两阶段流水线:第一阶段将多模态输入转换为标准化的运动信息(如人体姿态、深度图、密度场),第二阶段利用这些运动信号引导视频生成。用户只需提供几张目标人物的照片,即可生成与之匹配的动画视频。

核心优势