Rnj-1 模型在代码数学 STEM 上超越同类 Essential AIRnj-1 在代码、数学和 STEM 方面表现出色,超越同类及同规模的其他模型。在 SWE-bench 上,它比同等规模模型强一个数量级——仅在纯 bash 模式下获得 20.8% 的 SWE-bench Verified 分数,击败 Gemini 2.0 flash,与 GPT-4o 持平。Rnj-1 展示了当质量而不仅仅是数量驱动模型设计时可能实现的效果。 动态Essential AI2025-12-06原文 打开互动版