Gemma 4 31B 在 RTX 上通过 llama.cpp 加速 2.7 倍 NVIDIA AI PC@GoogleGemma 4 31B 在 RTX 上使用 llama.cpp 速度提升高达 2.7 倍。感谢 @ggerganov 与我们合作使这个模型变快。 动态NVIDIA AI PC2026-04-02原文 打开互动版