VUI Labs 发布 Luna-TTS,登顶 Hugging Face TTS Arena
VUI Labs 的 Luna-TTS 用扩散架构刷新 TTS 榜单,展示了中国团队在语音合成方向的技术突破。
中国初创 VUI Labs 发布 Luna-TTS 语音模型,登顶 Hugging Face TTS Arena。它采用双向扩散架构(一种并行生成语音的机制)替代传统逐字生成,辅以新型音频编码器,在多项语音质量和效率指标上拿下第一。
正文摘录
 新智元报道  刚刚,「中国版 Thinking Machines Lab」诞生! 全球语音与交互界,骤然杀出一家撼动格局的硬核 AI 初创。 它,就是宇生月伴(VUI Labs)。 在语音界最权威榜单之一的 Hugging Face TTS Arena 上,VUI Labs 的 Luna-TTS 模型力压群雄,击败了 ElevenLabs,以及 MiniMax、Cartesia 等国内外明星大厂,强势登顶全球第一!  在独立 AI 评测平台 Artificial Analysis 的 Speech Arena 榜单上,它直接超越了谷歌,获得全球第三!  这家大放异彩的中国硬核 AI 初创公司,愿景清晰而宏大——从高精度的 TTS 语音模型切入,以语音作为最具自然感与即时性的交互入口,最终贯通多模态,打通全双工的 Voice Agent 闭环。 无论是以语音为突破口构建新一代交互范式,还是通过实时语音反馈倒逼多模态基座能力的演进,它都展现出了与 Thinking Machines Lab 较为相似的路线。两家公司的路线,竟然不谋而合。