Qwen3.5系列发布,支持4-bit量化,长上下文可达1M+。
Qwen3.5系列在4-bit权重和KV缓存量化下保持近乎无损的精度。
在长上下文效率方面:
Qwen3.5-27B支持800K+上下文长度
Qwen3.5-35B-A3B在32GB显存的消费级GPU上超过1M上下文
Qwen3.5-122B-A10B在80GB显存的服务器级GPU上支持1M+上下文长度
此外,我们已开源Qwen3.5-35B-A3B-Base模型,以更好地支持研究与创新。
我们迫不及待想看到社区的下一步构建!
在长上下文效率方面:
Qwen3.5-27B支持800K+上下文长度
Qwen3.5-35B-A3B在32GB显存的消费级GPU上超过1M上下文
Qwen3.5-122B-A10B在80GB显存的服务器级GPU上支持1M+上下文长度
此外,我们已开源Qwen3.5-35B-A3B-Base模型,以更好地支持研究与创新。
我们迫不及待想看到社区的下一步构建!
🚀 推出Qwen 3.5 Medium模型系列
Qwen3.5-Flash · Qwen3.5-35B-A3B · Qwen3.5-122B-A10B · Qwen3.5-27B
✨ 更智能,更少计算。
• Qwen3.5-35B-A3B现已超越Qwen3-235B-A22B-2507和Qwen3-VL-235B-A22B——这提醒我们更好的架构、数据质量,https://t.co/ZWPibMn6at