OpenVoice

只需一段短音频就能克隆声音并生成多语言语音,还能精细控制情感、口音等风格,开源且性能强大。

voice 🆓 免费 🔓 开源
✨ 仅需短音频即可克隆声音✨ 支持情感、口音等精细控制✨ 零样本跨语言语音克隆✨ 计算效率高,成本极低✨ 开源免费,代码和论文可查
🌐 访问官网 →

产品概述

OpenVoice 是一个开源的即时语音克隆工具,由 MyShell 团队开发。它只需要参考说话人的一小段音频片段,就能准确复制其音色,并生成多种语言的语音。不仅如此,OpenVoice 还支持对语音风格进行精细控制,包括情感(如开心、悲伤)、口音(如印度、英国)、节奏、停顿和语调等。它还能实现零样本跨语言语音克隆,即使目标语言未出现在训练集中也能正常工作。计算效率极高,成本仅为商用 API 的几十分之一。

核心优势