行业新闻

StartLux 开源决策模型 StartLux-Decision,评测得分超过 Jev

决策模型专做 Agent 里的选择题,StartLux 用完全开源的版本在公开评测上超过 Jev,单次判断只需几十毫秒。

9 月 30 日,上海 AI 公司 StartLux 发布完全开源的决策模型 StartLux-Decision,覆盖 0.8B 到 27B 五档版本。在 Decision Index 0.2.1 的 38 项基准测试中,27B 版本有 31 项高于 Jev 1.13,综合得分 63.88 对 57.91。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/4bf69f1f-0f5a-42a5-99d9-47936078da66/042(2).jpg) 9 月 30 日,一款决策模型正式发布,迅速引发巨大关注:在 Decision Index 0.2.1 的 38 项基准测试中,它有 31 项成绩超过当前最热门的 Jev,综合得分 63.88 对 57.91,领先公开榜首近 6 分;而且,它完全开源。 实战对比更能说明问题——在与 Jev 的国际象棋对弈中,它的响应速度与对手不相上下,却在 36 局中赢下 35 局。 拿出这款模型的公司,正是当下炙手可热的上海 AI 明星企业 StartLux(原点星辉)。这家成立不到 5 个月的公司,已经是第二次拿出震惊业界的成果:上一次,StartLux-27B 的本地模型在工信部中国信通院测试中超过 284B 的 DeepSeek-V4-Flash;并以约 1/60 的参数量基本打平 DeepSeek-V4-Pro。这一次,是完全开源的 StartLux-Decision——以公开评测的综合成绩而论,它已经是目前全球最强的决策模型。 超过 Jev 这次,StartLux 的 Decision 模型一口气推出 0.8B、2B、4B、9B 和 27B 五档版本,并提供支持本地部署的量化模型。 - GitHub 链接:https://github.com/StartLuxLabs/Startlux-Decision - Hugging Face 模型合集下载:https://huggingface.co/collections/startlux-models/startlux-decision-6abba92b301b573fa154d493 实力如何?不妨先看一盘国际象棋。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-10-03原文

相关内容