动态

Qwen3.5-9B模型在低显存下表现优异。

Qwen3.5-9B模型在低显存下表现优异。
Itamar Golan
这是一个严肃的行动。

Qwen3.5-9B表现远超其规模——强大的多语言性能、广泛的一般知识,以及对于9B模型来说令人惊讶的强视觉能力。

在我的设置中,使用Q4_K_XL量化并开启完整的256k上下文,我看到了大约每秒40个token,全部在16GB VRAM以内。

中国的开源模型正在迅速缩小差距。
Qwen
🚀 推出Qwen 3.5小型模型系列
Qwen3.5-0.8B · Qwen3.5-2B · Qwen3.5-4B · Qwen3.5-9B

✨ 更智能,更低计算量。
这些小型模型基于相同的Qwen3.5基础——原生多模态、改进架构、规模化RL:
• 0.8B / 2B → 小而快,https://t.co/90JfOM9k4T
动态Itamar Golan2026-03-03原文

相关内容