感谢@ggerganov发布Llama.cpp新版本
感谢精彩的分享!感谢 @ggerganov 发布新的 Llama.cpp 版本!
Llama.cpp 现在在 Metal 上运行 Qwen3-30B-A3B-Thinking-2507 更快了!快得多!🔥
我将在 3090 TI 上使用 Cuda 重新测试并发布更新的基准测试!
感谢 @ggerganov 的新版本!https://t.co/FzNa4hX7gm
Llama.cpp 现在在 Metal 上运行 Qwen3-30B-A3B-Thinking-2507 更快了!快得多!🔥
我将在 3090 TI 上使用 Cuda 重新测试并发布更新的基准测试!
感谢 @ggerganov 的新版本!https://t.co/FzNa4hX7gm