Anthropic 前工程师:6 美元图架构抓漏 30 万评测套件
AdiPolak · x · 2026-08-25
Anthropic 前工程师分享了一种内部使用的图架构(Graph),月成本仅 6 美元,却能捕捉到价值 30 万美元的标准评测套件所遗漏的问题。该架构不包含检索层,仅由 7 个节点和 1 条规则组成。
核心理念是:图不是执行顺序,而是行动原因的记忆。7 个节点分工明确:
- INTENT: 定义任务目的(而非做法)
- DECOMPOSE: 拆解步骤并附带假设
- WORKER: 执行单步,无其他视野
- AUDIT: 根据假设检查输出
- DRIFT: 对比 INTENT 标记偏差
- LEDGER: 存储决策及其依据假设
- ROOT: 保存图结构,假设崩塌时重跑相关步骤
作者已发布完整模式,并主张 2026 年构建多智能体系统不应再是串行等待的直线流程。
「编程与Agent」频道最新
- AI 智能体应具备四种记忆类型以模拟人类能力 — _jaydeepkarale · 2026-08-25
- 印度金融科技印地语语音智能体踩坑复盘:数字播报与并发延迟才是真难点 — admrys · 2026-08-25
- 未来是独立于平台和LLM的:SaaS给agent而非MCP是自恋 — shensi · 2026-08-25
- AI 写代码的权衡术:按模块区分快速交付与深度审查 — arpit_bhayani · 2026-08-25
- 腾讯发布 GameXpert-Bench,评测智能体游戏开发全流程能力 — Tencent-Hunyuan · 2026-08-25
- Grok Bot 自动读取订单完美构建购物车 — elonmusk · 2026-08-25