动态

阿里发布Qwen3.8-Flash多模态MoE,低成本高性能,开放权重。

阿里发布Qwen3.8-Flash多模态MoE,低成本高性能,开放权重。
Victor M
转发 @Alibaba_Qwen: ⚡认识一下Qwen3.8-Flash,一个多模态MoE,也是Qwen4架构的早期预览版,现已开放权重!生产版Qwen3.8-Flash即将通过QwenCloud API提供,输入每百万token仅需0.16美元,输出每百万token仅需0.47美元。125B参数+51B N-gram嵌入,每个token仅激活6B参数。性价比无与伦比。新特性:🥳 - 下一代架构:GDN+QSA混合注意力、门控残差、N-gram嵌入和Muon优化器,是Qwen4所用架构的前身。 - 训练和推理成本显著降低:训练成本仅为Qwen3.7-Plus的1/9,但全面超越其性能,尤其在编码和办公任务上表现突出。 - 性能强劲:在DeepSWE 1.1上得分58.7,SWE-bench Pro上62.5,CoWorkBench上73.9,AndroidWorld上84.5,MathVision(带CI)上95.7。 - 原生上下文262K,可通过YaRN扩展到1M。我们还发布了Qwen3.8-Flash-Next的权重,让社区提前了解我们为Qwen4探索的新架构。🚀 我们迫不及待想看到你用Qwen3.8-Flash构建什么!👀👇 - 博客:https://t.co/M5hYypFLgJ - 技术报告:https://t.co/IF0gObIkQO - Hugging Face:https://t.co/6ow8QVAABt - ModelScope:https://t.co/tDOn2jNuFG
动态Victor M2026-08-26原文

相关内容