Synthesia 为记者定制交互式数字分身,仅能回答指定报道话题
Synthesia 让记者用两分钟录音做出可对话的数字分身,但只答被训练过的话题——体验惊艳,能力边界也很清楚。
TechCrunch 记者在 Synthesia 纽约办公室用一组照片和两分钟录音做出了自己的交互式数字分身,由语音转文字、语言模型、文字转语音和视频模型串联驱动。它只回答被训练过的那篇报道相关问题,问别的都会被拉回原题;团队还能替换成 ElevenLabs、Google、OpenAI 等第三方模型。
正文摘录
今年夏天,视频生成初创公司 Synthesia 的企业事务负责人 Alexandru Voica 给我发来一个链接,介绍他们 PR 团队的最新成员,我当时很惊讶。那是他的一个 [interactive virtual avatar](https://www.synthesia.io/post/synthesia-ai-press-officer),经过训练,能回答关于 Synthesia 的常见媒体提问,比如它是做什么的、怎么运作的。就在前一天,我参加了一个小组讨论,PR 从业者问我,是否介意使用 AI 生成文本的 pitch。但 Alexandru 的分身已经超越了这一点——在我看来,这就是 PR 领域使用 AI 的最终 Boss。 九月,Synthesia 邀请我去它位于纽约的新办公空间。Synthesia 原本base在英国,是与 D-ID、HeyGen、Colossyan 等齐名的热门数字分身初创公司。它[在今年早些时候达到 40 亿美元估值](https://techcrunch.com/2026/01/26/synthesia-hits-4b-valuation-lets-employees-cash-in/),并表示去年 [ARR 已突破 1 亿美元](https://www.synthesia.io/post/100-million-revenue-adobe-investment)。