阿里发布Qwen3.8-Flash,称其为Qwen4架构预演
阿里逆势发布低价高性能的Qwen3.8-Flash,其架构是Qwen4的预演,重新定义大模型性价比前沿。
阿里发布Qwen3.8-Flash,API版与开源版Qwen3.8-Flash-Next为同一模型。它在智能体编程、长周期办公等基准上超越参数量三倍的前代,并大幅领先Claude Opus 4.6;但并非全面占优,部分基准仍落后。定价每百万token输入1元、输出3元,仅为Qwen3.8-Max的十二分之一,也低于调价后的DeepSeek V4 Flash。
正文摘录
- title: 刚刚,Qwen3.8-Flash 震撼发布,我们看到了 Qwen4 的骨架 - sourcecompany: 机器之心 - bodymarkdown: .jpg) 编辑|Panda、山辉 8 月 17 日零点,DeepSeek 新的 API 价格正式生效。 V4 全系启用峰谷分时计费,工作日 9:00 至 12:00、14:00 至 18:00 按高峰价结算,其余时段价格减半。想不到,大模型也有需要「错峰用电」的一天。 第三方核算显示,V4 Flash 闲时缓存未命中输入价格上涨约 57%,闲时输出上涨约 136%,高峰时段的输出价格则接近旧价的 4.7 倍。  DeepSeek V4 系列 API 新旧价格对比。数据来源:Ginger Labs 涨价的不止一家。此前 OpenAI、谷歌和 Anthropic 已相继上调 API 价格或收缩免费额度。过去两年,大模型厂商一路把价格往下打,在 2026 年下半年,这条价格曲线却开始集体掉头。 原因并不复杂。推理需求的增长跑赢了算力供给的增长,而 Agent 把单次调用变成了几十次调用。