动态

测试unsloath的Qwen3.5模型在RTX5090上的速度

测试unsloath的Qwen3.5模型在RTX5090上的速度
ぱぷりか炒め
尝试了 unsloth 的 Qwen3.5-397B-A17B-MXFP4_MOE 模型,RTX5090 x2 GPU+CPU,llama-server 大约 13 t/s。抛开游戏性不谈,也能做出类似氛围的游戏。
动态ぱぷりか炒め2026-02-16原文

相关内容