千问办公首发上线 Qwen3.8-Flash,生成速度提升100%,Token 消耗减少75%
千问办公发布 Qwen3.8-Flash,以更低 Token 消耗和更快速度完成日常任务,显示模型与 Agent 协同优化正突破性能、成本、速度的制约。
8月26日,千问办公上线新模型 Qwen3.8-Flash,并推出标准模式。该模型参数规模达千亿级,性能超越 Claude Opus 4.6,且针对办公场景优化。实测中,单任务生成速度提升约100%,Token 消耗平均减少75%。未来95%日常任务用标准模式即可完成,只有5%复杂任务需高级模式。
正文摘录
- title: 千问办公首发上线 Qwen3.8-Flash,生成速度提升 100%,Token 消耗减少 75% - sourcecompany: 量子位 - bodymarkdown: 8月26日晚,千问办公首发上线刚刚发布的 Qwen3.8-Flash 模型,同时推出标准模式。 8月26日晚,千问办公首发上线刚刚发布的 Qwen3.8-Flash 模型,同时推出标准模式。即日起,所有用户可通过全新的标准模式体验 Qwen3.8-Flash。基于最新的模型,用户可以用更少的积分消耗、更快的 Token 吞吐速度完成任务。未来,千问办公的模型供给将只有标准和高级两种模式,95% 的日常任务通过千问办公标准模式即可完成,仅 5% 的复杂任务需要使用高级模式。 用户体验的提升来自模型升级与 Agent 协同优化。全新架构的 Qwen3.8-Flash 以千亿级总参数实现了超越 Claude Opus 4.6 的性能。同时,千问大模型团队与千问办公团队还联合推出了办公专属版本 Qwen3.8-Flash,针对多步规划、工具选择、上下文压缩等场景进行专项训练调优,并通过推理优化和定制 Harness 架构进一步实现吞吐效率提升。在真实办公场景测试中,千问办公标准模式的单任务生成速度提升约 100%,Token 消耗平均减少 75%。 在真实 AI 应用场景,高性能通常意味着高成本和高延迟,低成本则需要以牺牲智能为代价。Agent 与模型的深度协同优化,正在打破性能、成本和速度的"不可能三角"。随着模型智能密度的持续提升,以及千问办公与模型的双向优化,Agent 即将告别 Token 焦虑,迎来"量大管饱"时代。 量子位 QbitAI 版权所有 © 北京极客伙伴科技有限公司 京ICP备17005886号-1