行业新闻

OpenAI 发布 GPT-Live,ChatGPT 语音交互更自然

GPT-Live 通过全双工架构和任务委派,实现自然流畅的语音对话,支持随时打断和后台推理。

OpenAI 推出 GPT-Live,一种基于全双工架构(可以同时听和说)的语音模型。它能用 mhmm 回应表示在听,允许用户随时打断或沉默思考,还能委派复杂任务给 GPT-5.5 而不中断对话,使语音交互更接近真人交流。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/eaca7bb7-4be5-46f4-89ca-77e14b44b374/029(2).jpg) 深夜,OpenAI 突然上线 GPT-Live。 这款新一代语音模型,把 ChatGPT Voice 往前推了一步:人与 AI 的交流开始更像一场真正的对话。 GPT-Live 基于全双工架构构建,也就是说,它可以同时听和说。在对话过程中,GPT-Live 可以用 mhmm 或 yeah 这样的回应表示自己正在听,也可以进行快速来回交流;当你需要一点时间思考时,它也会保持安静。最终带来的,是一种非常轻松自然的语音交互体验。[![](https://image.jiqizhixin.com/uploads/editor/f67ff767-675c-4767-aeb5-a97e654dc3c0/1783562796476.png)](https://mp.weixin.qq.com/s/w9dCLGw8tVDvRHsHXC73uQ) OpenAI 表示,GPT-Live 是他们迄今最智能的语音模型。对于需要网页搜索、更深入推理或更复杂处理的问题,它会在后台交给这个最新前沿模型完成,并在结果准备好后带回对话中。在处理这些任务的同时,GPT-Live 仍然可以继续与你交流,维持对话的流畅性。 发布时,GPT-Live 后台调用的模型是 GPT-5.5。随着 OpenAI 后续推出新的前沿模型,GPT-Live 所调用的后台模型也会持续更新。 从今天开始,OpenAI 将在全球范围内向 ChatGPT 用户逐步推出两个版本的 GPT-Live,分别是 GPT-Live-1 和 GPT-Live-1 mini。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-07-09原文

相关内容