行业新闻

OpenAI 发布 GPT-5.6:入门款降价八成,新增 Fast mode

GPT-5.6 大幅降价并新增 Fast mode,让高端模型进入高频工作流,靠自身优化降本增效。

OpenAI 将 GPT-5.6 入门款 Luna 的输入价格从每百万 Token 1 美元降至 0.2 美元,输出从 6 美元降至 1.2 美元,降幅达 80%。定位日常主力的 Terra 降价 20%,旗舰 Sol 价格不变但推出提速 2.5 倍的 Fast mode。模型降价后开始进入代码审查等高频 Agent 场景。

正文摘录

入门款 Luna 直接打骨折,每百万 Token 输入价格从 1 美元降到 0.2 美元,输出价格从 6 美元降到 1.2 美元。 换算成人民币,相当于输入价格从约 6.8 元降到 1.35 元,输出价格从约 40.6 元降到 8.1 元。 定位「日常干活主力」的 Terra 也降价 20%,输入、输出价格分别降到 2 美元和 12 美元。 只有旗舰模型 Sol,稳坐原价,但推出了 Fast mode,速度最高达到标准模式的 2.5 倍,加速不加价。 其输入价格已经和上一代 GPT-5.4 nano 持平,输出价格甚至还便宜 0.05 美元。 但两款模型干的活不完全一样,GPT-5.4 nano 主要面向分类、信息抽取和排序等简单高频任务。 GPT-5.6 Luna 则被 OpenAI 定位为一款面向成本敏感型工作负载的模型,可以调用工具、处理长上下文,执行多步工作流。 简单来说,OpenAI 正在把支撑 Agent 干活的模型,卖到过去简单小模型的价位。 Sol 则保持原价,新增了 Fast mode,速度最高达到标准模式的 2.5 倍,价格则是标准模式的 2 倍,模型智能水平不变。 它还会取代此前的 Priority Processing。原本使用 priority 标签的 API 请求,可以自动切换到 Fast mode。 订阅价格不会下调,用户的额度总量也不会增加,但调用 Terra 和 Luna 时,消耗的额度将相应减少。 OpenAI 还顺手把 ChatGPT 和 Codex CLI 里的 Auto-review 模型从 GPT-5.4 换成了 GPT-5.6 Luna。 Auto-review 负责在后台检查代码和修改结果,属于典型的高频 Agent 任务。

阅读原文(qbitai.com)→

行业新闻听雨2026-07-31原文

相关内容