EchoMimic

蚂蚁集团开源的AI肖像动画工具,用音频或姿势驱动静态人像生成口型同步、表情生动的视频,效果优于同类产品。

Github 🆓 免费 🔓 开源
✨ 音频+姿势混合驱动,效果自然稳定✨ 可编辑面部特征点,支持精细控制✨ 支持唱歌及多语言(中英文)✨ 提供WebUI/Gradio图形界面✨ 完全开源,社区活跃,可集成ComfyUI
🌐 访问官网 →

产品概述

EchoMimic 是由蚂蚁集团支付宝终端技术部开发的开源肖像动画生成工具。它能够通过音频、姿势或两者的混合输入,驱动静态人像图像生成动态视频,实现口型同步、面部表情和头部动作的自然模拟。相比 SadTalker、MuseTalk 等方案,EchoMimic 在表情丰富度和动作流畅性上表现更优,支持唱歌、多语言(中英文)等多种场景。

核心优势