Fish Audio 获 5000 万美元种子轮融资
Fish Audio 凭借开源语音模型和付费 API 服务快速崛起,获 5000 万美元种子轮,但需解决声音未经同意被上传的信任问题。
AI 语音生成市场巨大,但创作者需要更富表现力的声音,企业需要更可控的语音。Fish Audio 提供超过 1.5 万种自然语言控制,开源模型已获 800 万用户,ARR 达 2100 万美元。本轮融资 5000 万美元,由 Coreline Ventures 和 Capital Today 领投。
正文摘录
Fish Audio 融资 5000 万美元种子轮,为创作者和企业构建 AI 语音模型 AI 生成语音模型的市场非常庞大。创意用例需要 AI 语音模型更具表现力,而寻求自动化客户支持和销售运营的企业,则要求模型更具可控性。 总部位于帕洛阿尔托的 Fish Audio 希望通过其拥有超过 15,000 种自然语言控制的库,来满足所有这些用例。自去年上线以来,这家初创公司如今已有超过 800 万人使用其模型的开源版本或托管版本,现在年度经常性收入(ARR)达到 2100 万美元。 为了在现有势头的基础上继续发展,该初创公司于周二宣布,已在一轮由 Coreline Ventures 和 Capital Today 领投的种子轮融资中筹集了 5000 万美元。参投方还包括 359 Capital、Parable、Play Time、Alphalist Partners、Bayhouse Ventures、Carya Venture Partners 和 HF0。 Fish Audio 最初是前 NVIDIA 研究员 Shijia Liao 的一个小项目。他对市场上缺乏表现力的合成语音感到沮丧,于是用单张 GPU 训练了一个语音生成模型,并将其开源。GitHub 上的 Fish Speech 仓库现在已获得超过 31,000 颗星,被独立开发者、电子游戏设计师和创作者使用。 该公司在过去一年内发布了五个模型:四个语音生成模型和一个语音转文本模型。它开源了其中三个语音生成模型,但其最新的 S2.1 Pro 模型仅通过付费 API 提供。 Fish Audio 提供面向创作者和团队的付费月度计划,可解锁一定数量的生成分钟数,外加声音克隆功能。该公司还提供其 API 和平台的企业版,并表示 HeyGen、Sanas 和 Plaud 等组织已在采用。 “每家企业都有不同的用例和偏好。