行业新闻

清华团队开源代码模型 VeriLoop Coder-E1

一个代码模型不仅会修 bug,还能让修复方法本身被验证和进化,这次开源了权重。

清华团队开源了 VeriLoop Coder-E1,一个基于 Qwen3.6-27B 的代码模型,专攻仓库级代码修复。它用“循证螺旋”机制——每轮修复都被证据验证、推翻再修正——在 SWE-bench 等基准上超过多数开源模型。

正文摘录

清华团队 VeriLoop Coder-E1 正式开源:以循证螺旋驱动可验证的递归式自我改进 近日,由清华大学深圳国际研究生院智能机器人实验室刘厚德教授领衔、王立博博士后担任 AI 首席研究员的大模型团队,正式发布了 VeriLoop Coder-E1 —— 一款基于 Qwen3.6-27B 构建、面向仓库级代码修复与智能体式软件工程任务的开源垂类代码模型。 该模型在 Hugging Face 四项软件工程 Benchmark 中分别取得 SWE-bench Verified(85.20)、SWE-bench Pro(62.38)、Terminal-Bench 2.0(76.40)和 DeepSWE(33.63)的成绩。 截止 2026 年 7 月 27 日,在 32B 及以下开源模型的比较范围内,VeriLoop Coder-E1 在 SWE-bench Verified、SWE-bench Pro 和 Terminal-Bench 2.0 中排名第一,在 DeepSWE 中排名第二。在所有的开源模型中,包含一众知名模型的情况下,分别排名为第二、第一、第一和第五,统计情况如下表。 说明:对模型综合能力作出全面评估,需明确基准评测的证据边界。基准评测仅反映模型在特定任务分布、评测协议与运行条件下的相对表现,不能据此推断其在真实软件工程环境中的整体能力。因此,本文不将四项基准评测成绩视为模型能力的最终裁决,仅客观记录相关评测结果与排名事实。数据来源:Hugging Face 对应 Benchmark 排行榜,见 [5]—[8] VeriLoop Coder-E1 背后的循证螺旋 VeriLoop Coder-E1 的核心优势来自窄域 PEFT 微调与 Self-Harness 的协同。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-08-02原文

相关内容