小米发布开源MoE模型MiMo-V2-Flash,速度极快,匹配DeepSeek-V3.2
⚡ 比快更快。专为 Agentic AI 设计。
推出小米 MiMo-V2-Flash——我们的新开源 MoE 模型:309B 总参数,15B 激活。
极速与前沿性能兼具。
🔥 亮点:
🏗️ 混合注意力:5:1 交错 128 窗口 SWA + 全局 | 256K 上下文
📈 性能:
⚔️ 在通用基准上匹配 DeepSeek-V3.2——延迟仅为其一小部分
🏆 SWE-Bench Verified: 73.4% | SWE-Bench Multilingual: 71.7%——开源模型新 SOTA
🚀 速度:150 输出 tokens/s,@lmsysorg 提供 Day-0 支持🤝
🤗 模型:https://t.co/4Etm0yZKTL
📝 博客文章:https://t.co/5zxmcDuB6o
📄 技术报告:https://t.co/crac1YTLYl
🎨 AI Studio:https://t.co/nSReUs6QgW
推出小米 MiMo-V2-Flash——我们的新开源 MoE 模型:309B 总参数,15B 激活。
极速与前沿性能兼具。
🔥 亮点:
🏗️ 混合注意力:5:1 交错 128 窗口 SWA + 全局 | 256K 上下文
📈 性能:
⚔️ 在通用基准上匹配 DeepSeek-V3.2——延迟仅为其一小部分
🏆 SWE-Bench Verified: 73.4% | SWE-Bench Multilingual: 71.7%——开源模型新 SOTA
🚀 速度:150 输出 tokens/s,@lmsysorg 提供 Day-0 支持🤝
🤗 模型:https://t.co/4Etm0yZKTL
📝 博客文章:https://t.co/5zxmcDuB6o
📄 技术报告:https://t.co/crac1YTLYl
🎨 AI Studio:https://t.co/nSReUs6QgW