OpenAI 发布 GPT-6 Sol 与 Luna,主打更快更便宜的编码与智能体能力
RT @reach_vb:隆重推出 GPT-6 Sol 和 Luna,把 Astra 背后的技术进展带给更快、更实惠的模型。✨
💻 更强的编码与电脑操作能力
🎯 更好的事实准确性与对齐
💬 更清晰的回答,少一些术语黑话
> 在 AutomationBench 上,Sol 在 xhigh effort 下的表现超过 Claude Opus 5 在 max effort 下的表现,而每个任务的成本仅为其 9%。
> 在离线版 OSWorld 2.0 上,Luna 在 max effort 下超过 GPT-5.6 Sol 在 medium effort 下的表现,成本只有其十分之一。
> 在我们内部的真实性评测中(针对用户此前标记过错误的对话),Sol 的错误量约为 GPT-5.6 Sol 的一半。
> 改进后的 prompt caching 帮助 agent 复用更多上下文,缓存输入 token 的读取可享 90% 折扣。开发者可以调整推理强度和工具可用性,而不会破坏缓存。
今天起在 ChatGPT Work 和 Codex 中面向 Plus、Pro、Business、Enterprise 和 Edu 用户逐步推送,并已在 OpenAI API 中提供。Free 和 Go 用户可在桌面应用中访问 Luna。这些模型尚未在 Chat 中提供。
API 定价(每 100 万 token):
Sol:$2 输入 / $10 输出
Luna:$0.10 输入 / $0.50 输出
💻 更强的编码与电脑操作能力
🎯 更好的事实准确性与对齐
💬 更清晰的回答,少一些术语黑话
> 在 AutomationBench 上,Sol 在 xhigh effort 下的表现超过 Claude Opus 5 在 max effort 下的表现,而每个任务的成本仅为其 9%。
> 在离线版 OSWorld 2.0 上,Luna 在 max effort 下超过 GPT-5.6 Sol 在 medium effort 下的表现,成本只有其十分之一。
> 在我们内部的真实性评测中(针对用户此前标记过错误的对话),Sol 的错误量约为 GPT-5.6 Sol 的一半。
> 改进后的 prompt caching 帮助 agent 复用更多上下文,缓存输入 token 的读取可享 90% 折扣。开发者可以调整推理强度和工具可用性,而不会破坏缓存。
今天起在 ChatGPT Work 和 Codex 中面向 Plus、Pro、Business、Enterprise 和 Edu 用户逐步推送,并已在 OpenAI API 中提供。Free 和 Go 用户可在桌面应用中访问 Luna。这些模型尚未在 Chat 中提供。
API 定价(每 100 万 token):
Sol:$2 输入 / $10 输出
Luna:$0.10 输入 / $0.50 输出