清华团队开源 VeriLoopCoder-E1,提出循证螺旋代码智能体架构

机器之心 · wechat · 2026-08-02

清华大学深圳国际研究生院团队发布了开源代码修复模型 VeriLoopCoder-E1。该模型基于 Qwen3.6-27B 构建,在 SWE-bench 等四项基准测试中,于 32B 及以下开源模型范围内斩获三个第一。

模型的核心优势在于窄域 PEFT 微调与 Self-Harness 控制栈的协同。团队提出了循证螺旋机制,将传统的机械重试升级为「证-伪-探-修-验-化」的闭环。该机制要求每一轮代码生成与修复都必须接受证据的验证,只有通过验证的纠正才能进入下一轮,甚至改变系统未来发现和修复错误的方法,从而向递归式自我改进迈进。

目前,团队已依据 Apache 2.0 开源模型权重,但保留了负责多轮任务编排与状态维护的 Self-Harness 控制栈。未来,团队将重心转向研发能预测并承担行动后果的通用 Code Agent。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →