MiniMax 发布 Speech 2.8 语音模型,提升 AI 语音自然度
MiniMax 推出 Speech 2.8,通过细粒度声学优化让 AI 语音更自然、富有生命力,为对话式 AI 带来更真实的听觉体验。
MiniMax 最新发布的语音模型 Speech 2.8,通过改进声学建模和韵律控制,让合成语音听起来更自然、富有情感,接近真人发声。本次升级重点优化呼吸、语调等细微表现,使 AI 语音在对话、播客等场景中更具亲和力。
正文摘录
2026.1.23 MiniMax Speech 2.8:为 AI 语音注入生命力 [接入 API](https://platform.minimax.io/docs/api-reference/speech-t2a-intro) [立即试听](https://www.minimax.io/audio)  MiniMax Speech 2.8:为 AI 语音注入生命力 今天,我们激动地推出 MiniMax Speech 2.8。 这不只是一次技术升级,更是语音真实感的突破。通过引入原生音效标签支持、高保真克隆以及录音室级清晰度,我们正在缩小 AI 与人声之间的差距。 我们的使命始终明确:让合成语音真正听起来像人,难以分辨。 1. 重拾“微差”:教会 AI 犹豫与呼吸 过去,AI 语音常因“过于完美”而显得冰冷。真实的人声充满不完美的呼吸、停顿和犹豫——这些细微信号传递情感并强调重点。 Speech 2.8 引入了原生音效标签(Native Sound Tags)。通过建模口语填充词如“um”“uh”“ah”,我们保留了人类对话的自然节奏、音高和停顿。 再也没有机械的、平坦的语音;温暖藏在细节里。 Speech-2.8 音效标签演示 00:00 / 00:00 文本:“嘿,是我。你好吗?(轻笑)希望你今天过得超棒!