行业新闻

OpenAI与Cerebras推出GPT-5.6 Sol超高速模式,输出速度提升14倍

OpenAI与Cerebras合作让GPT-5.6 Sol提速14倍,打破了算力瓶颈,使旗舰模型能胜任更多即时任务,也预示着AI交互方式将改变。

OpenAI联合AI芯片厂商Cerebras预览了旗舰模型GPT-5.6 Sol的「超高速模式」,输出速度最高可达750 tokens/s(每秒生成的词元数,即模型每秒能写出的文本片段),比标准模式快14倍,且质量不变。该模式率先在API中开放预览,背后依赖Cerebras的晶圆级芯片架构,将模型参数常驻片上SRAM,绕开传统GPU的内存带宽瓶颈。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/76c3eb70-4edd-47c3-8e6c-3ab281adf1f0/044(2).jpg) AI 开始卷信息不对等了? 8 月 14 日凌晨,OpenAI 联合 AI 芯片厂商 Cerebras 正式预览了其旗舰模型 GPT-5.6 Sol 的全新服务层级「超高速模式」(Ultrafast Mode)。 在该模式下, GPT-5.6 Sol 的输出速度最高可达 750 tokens/s ,相比目前 Standard(标准)模式约 53 tokens/s 的推理基线,速度提升最高达 14 倍,同时不降低任何质量。横向对比的话,GPT-5.6 Sol 加速后比 Fable 5 快 11 倍,比 Opus 4.8 在 Fast 模式下快 5 倍。 Ultrafast 模式将率先在 OpenAI API 中推出,当前已面向部分客户推出有限预览版。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-08-14原文

相关内容