无需重训模型即可自我进化:Argus 智能体架构解析
imjustnewatai · x · 2026-08-07
递归自我改进或许在模型重新训练之前就能发生。最新论文提出的 Argus 智能体运行时,在保持 GPT-5.5 权重完全冻结的情况下,通过持久化工作空间实现了自我进化。
Argus 内部划分了 Manager、Planner、Engineer 和 Reviewer 等角色,只有通过证据验证的记忆、技能和失败路径才会被复用。在 731 项软件任务中,Argus 取得了约 78% 的得分,显著优于直接使用 Copilot 的 59%,尽管总体多消耗了 1.41 倍的 token。
更重要的是,随着经验积累,系统在成熟阶段的单任务耗时和 token 消耗比初始阶段下降了 15% 到 21%。这种机制表明,运行时可以在不改变模型权重的情况下不断优化搜索策略,而这些高质量的验证轨迹最终可用于训练下一代更强的模型。
所属事件:Argus智能体架构实现无需重训的自我进化(2 条相关)→
「编程与Agent」频道最新
- 两三条 Prompt 让 Opus 5.5 生成灯笼节水景大场面 — Silver-Chipmunk7744 · 2026-09-23
- stuntd:本地 22ms 学你流量的 Jev 兼容决策代理 — Inevitable-Log5414 · 2026-09-23
- 模型挂了 Agent 就得死?他花几个月造出状态持久化层 Metriqual — its_vayishu · 2026-09-23
- 给 Sonos MCP 服务器换上 OAuth 后的两个意外发现 — Mean-Gazelle5347 · 2026-09-23
- 为什么没有反 slop 编码评测?跑分 70% 却塞满没人要的烂测试 — yacineMTB · 2026-09-23
- WFM 论文:把 LLM Wiki 变成图,Agent 记忆检索提速 10.5 倍训练 — omarsar0 · 2026-09-23