动态

比较Hermes Agent与OpenCode在多个模型上的性能,结果因配对而异。

比较Hermes Agent与OpenCode在多个模型上的性能,结果因配对而异。
Teknium 🪽
转推 @gmi_cloud: 我们使用 Hermes Agent 和 OpenCode 在 Hugging Face 的 tinyMMLU 数据集上测试了 GLM 5.2、Kimi K3 和 DeepSeek V4 Pro。结果因模型与 agent 的配对而差异显著。Hermes 在处理 Kimi K3 和 GLM 5.2 时速度更快、token 效率更高,而 OpenCode 在处理 DeepSeek V4 Pro 时效率更高。Kimi K3: Hermes Agent - 40秒 · 110K tokens · 96/100;OpenCode - 8分13秒 · 149K tokens · 93/100。GLM 5.2: Hermes Agent - 2分30秒 · 195K tokens · 94/100;OpenCode - 6分20秒 · 432K tokens · 94/100。DeepSeek V4 Pro: Hermes Agent - 3分44秒 · 1.23M tokens · 0.15美元 · 97/100;OpenCode - 3分25秒 · 795K tokens · 0.06美元 · 95/100。免责声明:在 Hermes Agent 上测试的所有模型均使用 GMI Cloud 的 API,OpenCode 上的 GLM 5.2 和 DeepSeek V4 Pro 也使用该 API。OpenCode 上的 Kimi K3 通过其他提供商运行。
动态Teknium 🪽2026-07-31原文

相关内容