Argus 智能体运行时:不改变权重实现长程推理自我进化
imjustnewatai · x · 2026-08-07
针对长程推理任务,最新论文提出了 Argus——一个持久化、可自我进化的智能体运行时。系统内置 Manager、Planner、Engineer 和 Reviewer 等角色,在持久的项目状态上执行受限任务。
Argus 的核心在于:模型权重保持固定,自我进化完全通过运行时状态和控制策略来实现。只有通过角色审查和任务验证后,记忆、技能、程序和失败路径才会被系统接纳。在 SWE-Bench Pro 测试中,Argus 取得了约 78% 的成绩,远超直接 Copilot 的 59%。经过验证的自我进化后,成熟阶段的单任务 token 消耗和耗时比初始阶段下降了 15% 到 21%。
所属事件:Argus智能体架构实现无需重训的自我进化(2 条相关)→
「编程与Agent」频道最新
- opencode 日处理 token 突破 8 万亿,直逼 Codex 与 Claude — ycombinator · 2026-08-07
- 腾讯提出InsightEmb:仅用数学数据训练智能体经验检索 — _reachsumit · 2026-08-07
- 为何还没有为 LLM 设计的编程语言?开发者呼吁优先考虑 AI — jfischoff · 2026-08-07
- 开源项目 Whatomate:整合 WhatsApp 与 AI 聊天机器人 — tom_doerr · 2026-08-07
- Agent 持续学习成行业共识,Pyromind 推自动化 RL 平台 — 机器之心 · 2026-08-07
- 实用 Hermes 提示词技巧:让 Agent 自查代码变更 — alexcovo_eth · 2026-08-07