Loom 给编程 Agent 加工程状态层,长任务可恢复可接管
机器之心 · wechat · 2026-07-26
Loom 给编程 Agent 加了一层独立工程状态,解决长任务失控
Valkor 联合浙江大学智能计算与软件研究中心、UCL 软件工程团队开源了 loom,目标是让长链路软件任务在真实工程流程里可持续推进、可验证、可恢复。
- 文章指出,现有 Coding Agent 在前几轮改 Bug、补接口时很惊艳,但任务一旦变长,就容易陷入“调试黑洞”:忘记目标、重复修改、反复道歉、日志越堆越乱。
- Loom 的关键思路是把 EngineeringState 从聊天上下文中拆出来,单独维护工程状态。
- 测试失败不再只是聊天记录里的文本,而会被结构化成下一步必须处理的状态;因此 bug 不容易被遗漏,也不会被噪音淹没。
- 这套状态链还支持多 Agent、跨模型接管:新 Agent 只要读取状态,就能知道当前进度、已改文件和下一步动作,不必重新读完冗长对话。
- 文章认为,单纯加长 context window 解决不了长任务问题,因为软件工程需要的是结构化和确定性,而不是更多杂讯。
- Loom 更像是面向严肃生产环境的 Agent 交付基础设施,也为未来的动态评测和微调数据收集提供了真实工程轨迹。
「编程与Agent」频道最新
- 用历史对话让编码 Agent 产出可复用规则 — zeeg · 2026-07-26
- 序列级 KL 估计器可为异步 RL 提供正确梯度 — ZacharyHuang12 · 2026-07-26
- Opus 5 被拍成“训斥” Sonnet 5 子代理的梗图 — dejavucoder · 2026-07-26
- 一个项目让开发者相信,Agent harness 比模型更重要 — alexcovo_eth · 2026-07-26
- Meta-agent 可能成为企业级智能体缺失的治理层 — shi_weiyan · 2026-07-26
- Prompt 缓存比换更便宜模型更省钱 — Illustrious-Bug2105 · 2026-07-26