黑客松原型:记住失败修复记录的事故响应 Agent,准确率从 0% 升到 50%
Fabulous-Ad9781 · reddit · 2026-09-29
一支黑客松团队展示了 Adaptive Incident Intelligence 原型:现有工单系统往往只记录「已解决」,丢失了先试了什么、哪些失败、什么最终恢复服务的关键序列。该原型用 Hindsight 检索相似历史案例,结合证据提出处置建议,并用确定性策略规则校验——高风险操作必须人工审批;执行后会重试原始失败操作并检查服务健康度,再记录结果。
评测方面,在 12 个保留的合成案例上,动作准确率从空记忆时的 0% 提升到加入证据后的 50%(团队强调这是小规模原型评测,非生产性能宣称)。技术栈为 FastAPI、React、Hindsight 和通过 Ollama 运行的本地模型。作者最关注的问题:有用的 agent 记忆与安全自动化之间的边界在哪里。
「编程与Agent」频道最新
- Matt Shumer 让 Opus 自主清空 3D 打印机料盘,16 次尝试后彻底脱管 — mattshumer_ · 2026-09-29
- 开发者放 Claude 一下午 autonomously 写出「p(doom) 版 Beat Saber」 — burny_tech · 2026-09-29
- AlignOPSD 决策对齐蒸馏,长程 Agent 性能超 GRPO 5.5-8.7% — Mingju Chen · 2026-09-29
- CMU 研究 Agent 该修订多少工作流:FULL 修复 15-16/20 优于 KEEP 13 — CarnegieMellonU · 2026-09-29
- CompoWorld 用可组合环境扩容通用智能体训练任务空间 — AllSpark-Research · 2026-09-29
- 北航提出 ACG 图结构记忆,长程 Agent 成功率 44.5% 提至 50.2% — Beihang · 2026-09-29