行业新闻

Qwen3.8-2.4T发布首日完成9款AI芯片适配,FlagOS实现多芯快速落地

Qwen3.8-2.4T发布首日即完成9款芯片适配,FlagOS证明统一软件栈能大幅缩短国产算力部署新模型的周期。

阿里巴巴开源了2.4万亿参数的MoE模型Qwen3.8-2.4T(总参数2.4T,激活参数95B,一种只激活部分参数的高效架构)。众智FlagOS社区在发布当天就完成了它在平头哥、英伟达、华为昇腾等9款芯片上的适配,提供BF16、FP8、INT8等多种精度版本,开发者可直接使用。这标志着统一软件栈让前沿模型“一次开发、多芯适配”具备了规模化能力。

正文摘录

阿里巴巴开源了超大规模 MoE(混合专家)模型 Qwen3.8-2.4T-A95B,众智 FlagOS 社区在 Day0(模型发布当天)同步完成了多芯片适配。Qwen3.8-2.4T-A95B 已在平头哥、英伟达、摩尔线程、华为昇腾、沐曦、昆仑芯、海光、清微智能、燧原等 9 家 AI 芯片上,基于 FlagOS 统一开源技术栈完成了多芯适配、精度对齐与部署验证。针对不同芯片的情况,提供了 BF16、FP8、INT8 等多种精度的版本,开发者可以直接获取对应芯片的开箱即用方案。 从今年 2 月首次开展 MiniCPM4.5-o 模型的多芯片 Day0 适配,到今天实现 Qwen3.8-2.4T 模型在 9 款芯片上的 Day0 适配,FlagOS 已累计完成了来自 7 大头部模型团队、12 款主流开源模型,覆盖多达 10 款芯片的跨芯 Day0 适配。这向 AI 芯片与大模型产业验证了一个事实:基于统一、开放的系统软件栈,实现前沿模型"一次开发、多芯快速适配"已经具备规模化落地的能力。 本次发布的 Qwen3.8-2.4T-A95B 是阿里巴巴开源模型系列中规模最大、能力最强的一代,首次将 Qwen-Max 级别的模型开放出来。主要特性: - 超大规模 MoE 架构,总参数 2.4T,激活参数 95B,纯文本模型 - 编程、专业工作、科研、长程智能体任务能力显著提升;支持 reasoningeffort 调节推理深度,preservethinking 保留历史推理 - 原生 262,144 tokens,可扩展至 1,010,000;

阅读原文(jiqizhixin.com)→

行业新闻新闻资讯2026-08-13原文

相关内容