推出Qwen2.5-Omni-3B轻量模型,VRAM降低50%+
一个小更新。尽管很多用户希望有更小的Omni模型用于部署,我们便构建了这个。尽情享受!
我们激动地宣布发布Qwen2.5-Omni-3B,使开发者能够使用轻量级GPU!
🔹 与Qwen2.5-Omni-7B模型相比,3B版本在长上下文序列处理(~25k https://t.co/jU7SyD91ph)中实现了惊人的50%以上的VRAM消耗减少🚀
我们激动地宣布发布Qwen2.5-Omni-3B,使开发者能够使用轻量级GPU!
🔹 与Qwen2.5-Omni-7B模型相比,3B版本在长上下文序列处理(~25k https://t.co/jU7SyD91ph)中实现了惊人的50%以上的VRAM消耗减少🚀