行业新闻

Introducing Voice Finder — 一个从 600+ 声音中快速为你的应用找到合适语音的新工具

Introducing Voice Finder — 一个从 600+ 声音中快速为你的应用找到合适语音的新工具

Together AI 推出 Voice Finder 工具,用自然语言或音频样本就能从 600+ 声音中快速匹配想要的语音,省去手动试听的麻烦。

Voice Finder 让开发者可以通过自然语言描述或上传音频样本,从 Together AI TTS 模型支持的 600 多种声音中搜索、匹配、筛选和试听,快速找到适合自己应用的那一款。

正文摘录

摘要 - [Voice finder](https://findtherightvoice.com/):搜索 600+ 种声音,涵盖 MiniMax、Cartesia、Deepgram、Rime 以及 Together AI 提供的其他模型。 - 通过提示词或音频搜索:描述你需要的语音,或上传一段简短的语音样本,即可找到相似声音,并附有可播放的推荐。 - 模型感知元数据:每种声音都标记了 15+ 个属性,包括音高、口音、语言、年龄、情感和说话风格。 为语音代理选择合适的声音仍然过于依赖手动操作。供应商的目录可能包含数十或数百种声音,而文档很少告诉你哪一种适合金融科技客服、冥想引导或游戏节目主持人。 Voice finder 为开发者提供了一种更快的方式来搜索 Together AI 的语音目录。输入你正在构建的场景,或上传你心目中声音的简短音频样本,然后比较排序后的推荐、在线试听,并根据对用例重要的属性进行筛选。 ![Voicefinder 演示动画](https://together-website.b-cdn.net/image/voicefinder.gif) 工作原理 Voice finder 对 Together AI 上 10 个 TTS 模型的 600+ 种声音建立了索引。每种声音都可以直接在工具中播放。 在排序层背后,一个全模态模型倾听了每一种声音,并生成了超过 15 个维度的结构化元数据,包括音高、性别、口音、语言、年龄、情感和说话风格。这些元数据同时支持自然语言搜索和手动筛选。 一些搜索示例: - “冥想应用所需的平静女声” - “金融科技客服代理所需的自信声音” - “游戏节目所需的活力主持人” - “客服所需温暖的双语声音” 目标很简单:从用例出发,快速获得一份简短的声音列表,以便继续构建。 这对语音代理意味着什么 语音代理不仅依赖模型质量。

阅读原文(together.ai)→

行业新闻2026-05-12原文

相关内容