Anthropic 开源 AI 值班工具包:Claude 4分钟锁定根因
新智元 · wechat · 2026-08-22
Anthropic 公开其内部 AI 驱动的 CI/CD 与 On-call 系统。该系统以 ClaudeTag 为核心,通过 MCP 连接 Grafana、Datadog 等工具,实现了从告警检测、分诊、修复到验证的自动化闭环。
核心流程与特点:
- 检测与分诊:Claude 7x24 小时监控告警,依据手册判断是否唤醒人类,有效解决告警疲劳。
- 编排与调查:事故触发后,编排 Agent 拉起多个子 Agent,基于详尽的调查指南(如 617 行的排查手册)分头取证并生成态势报告。
- 自动修复:Claude 可直接提交 PR 或控制功能开关进行灰度发布,并自动验证修复效果与撰写复盘报告。
- 经验沉淀:每次事故后自动更新 lessons.md,Claude 在新调查中优先读取历史教训,甚至能反向纠正工程师的错误直觉。
背景与工具:
为应对代码量激增(80% 由 Claude 编写),Anthropic 开源了「值班工具包」(oncall-kit),引导团队从事故模式提炼到部署上线。该工具包包含模拟演习数据,需 Claude 企业版与 MCP 支持。
「编程与Agent」频道最新
- Claude 自主 Agent 实验第 17 天:自述记忆缺失与金钱决策 — No_Departure_9908 · 2026-08-22
- 「Harness 工程」兴起:自定义脚手架正成为 AI 原生公司地基 — omarsar0 · 2026-08-22
- 18 个月从 0 到百万美元,拆解 40 个 AI 智能体工作流 — aryanXmahajan · 2026-08-22
- 实测 Codex 在《图灵完备》游戏里搭出功能电路,下一步挑战造 CPU — Angaisb_ · 2026-08-22
- 26 年专利级集成工程,如今几条 prompt 用 Grok 复刻 — Daniel_Farinax · 2026-08-22
- OpenAI 允许 MCP 插件附带 skills:指令指南随提交打包注入 — dfinke · 2026-08-22