心辰Lingo语音大模型

国内首个端到端通用语音AI大模型,能听懂情感、语气和环境音,中文效果超越GPT-4o,还支持唱歌、相声等多样表达。

coding 🎁 分层付费
✨ 国内首个端到端通用语音大模型✨ 能理解语音中的情感和语气✨ 中文语音效果超越GPT-4o✨ 支持实时打断和指令控制✨ 能说会唱,风格多样(相声、歌唱等)
🌐 访问官网 →

产品概述

心辰Lingo是西湖心辰团队研发的国内首个端到端通用语音大模型,2024年9月正式发布。与传统的“语音识别+文本处理+语音合成”分段式方案不同,它直接从语音输入到语音输出,完整保留并理解声音中的情感、语气、音调和环境音等细节,实现更自然、高情商的交互体验。模型采用超高压缩率的语音编解码器,大幅降低计算和存储成本,同时保持高质量输出。

核心优势

**情感理解与拟人表达**:心辰Lingo不仅能识别文字内容,还能精准捕捉用户的情感状态(如开心、失落、焦虑),并生成带相应情绪和语调的回复,让AI“有温度”。在中文语音处理上,效果甚至优于GPT-4o。 **多风格实时交互**:支持实时打断、实时指令控制,并能根据上下文自适应调整语速、音高和噪声强度。除了对话,还能生成歌唱、相声、讲故事等多种风格,极大拓展了应用场景。 **端到端高效架构**:通过语音模态超级压缩技术,实现数百倍压缩率,在保证音质的同时降低延迟和资源消耗,适合在边缘设备或云端大规模部署。

适用场景