动态

在 llama.cpp 上测试 421M 的 Laya 决策模型,速度是 Qwen 4B 的 12 倍,效果接近

在 llama.cpp 上测试 421M 的 Laya 决策模型,速度是 Qwen 4B 的 12 倍,效果接近
Victor M
决策模型 + 本地 AI = ❤️

在一个小型的「摘苹果」基准测试里,用 llama.cpp 试了 Laya(421M),它几乎和 Qwen 4B 一样好,而速度是后者的 12 倍。https://t.co/deDcDdWJbC
动态Victor M2026-10-06原文

相关内容