清华团队开源 VeriLoopCoder-E1,提出循证螺旋代码智能体架构
机器之心 · wechat · 2026-08-02
清华大学深圳国际研究生院团队发布了开源代码修复模型 VeriLoopCoder-E1。该模型基于 Qwen3.6-27B 构建,在 SWE-bench 等四项基准测试中,于 32B 及以下开源模型范围内斩获三个第一。
模型的核心优势在于窄域 PEFT 微调与 Self-Harness 控制栈的协同。团队提出了循证螺旋机制,将传统的机械重试升级为「证-伪-探-修-验-化」的闭环。该机制要求每一轮代码生成与修复都必须接受证据的验证,只有通过验证的纠正才能进入下一轮,甚至改变系统未来发现和修复错误的方法,从而向递归式自我改进迈进。
目前,团队已依据 Apache 2.0 开源模型权重,但保留了负责多轮任务编排与状态维护的 Self-Harness 控制栈。未来,团队将重心转向研发能预测并承担行动后果的通用 Code Agent。
「编程与Agent」频道最新
- Plannator 发布技能:用 HTML 生成 Agent 交互原型 — tom_doerr · 2026-08-24
- DocketBird MCP 服务器:支持搜索下载法院文档 — modelcontextprotocol · 2026-08-24
- AgentLux MCP 服务器:支持市场和社交流程 — modelcontextprotocol · 2026-08-24
- MongoDB 发布 Agent 工具包,让编码助手精通数据库 — TheTuringPost · 2026-08-24
- 开发软件前先让 Agent 查开源库,99% 的情况是正解 — generativist · 2026-08-24
- 开发者瓶颈不在 AI 上下文,而在人脑认知负荷 — Vidhrohi · 2026-08-24