请求移植Qwen2.5-Omni-3B的MLX实现
端口请求:
单文件、最小化、MLX实现的Qwen2.5-Omni-3B。
Qwen即一切。
单文件、最小化、MLX实现的Qwen2.5-Omni-3B。
Qwen即一切。
我们激动地宣布发布Qwen2.5-Omni-3B,让开发者可以轻松使用轻量级GPU!
🔹 与Qwen2.5-Omni-7B模型相比,3B版本在长上下文序列处理(约25k)中VRAM消耗显著降低50%以上🚀 https://t.co/jU7SyD91ph
我们激动地宣布发布Qwen2.5-Omni-3B,让开发者可以轻松使用轻量级GPU!
🔹 与Qwen2.5-Omni-7B模型相比,3B版本在长上下文序列处理(约25k)中VRAM消耗显著降低50%以上🚀 https://t.co/jU7SyD91ph