动态

Qwen3.5系列发布,支持4-bit量化,长上下文可达1M+。

Qwen3.5系列发布,支持4-bit量化,长上下文可达1M+。
Qwen
Qwen3.5系列在4-bit权重和KV缓存量化下保持近乎无损的精度。

在长上下文效率方面:

Qwen3.5-27B支持800K+上下文长度
Qwen3.5-35B-A3B在32GB显存的消费级GPU上超过1M上下文
Qwen3.5-122B-A10B在80GB显存的服务器级GPU上支持1M+上下文长度

此外,我们已开源Qwen3.5-35B-A3B-Base模型,以更好地支持研究与创新。

我们迫不及待想看到社区的下一步构建!
Qwen
🚀 推出Qwen 3.5 Medium模型系列
Qwen3.5-Flash · Qwen3.5-35B-A3B · Qwen3.5-122B-A10B · Qwen3.5-27B

✨ 更智能,更少计算。
• Qwen3.5-35B-A3B现已超越Qwen3-235B-A22B-2507和Qwen3-VL-235B-A22B——这提醒我们更好的架构、数据质量,https://t.co/ZWPibMn6at
动态Qwen2026-02-25原文

相关内容