研究称 AI 拦截危险指令远超人类,Claude Code 默认开启自动模式

Justgototheeffinmoon · reddit · 2026-08-09

Anthropic 宣布 Claude Code 默认开启自动执行模式。其内部对 1053 名测试者的研究表明,AI 分类器成功拦截了 89% 的危险命令,而人工审核仅能发现 13.6%,且人工准确率在处理 50 个提示后会因疲劳降至 5%。

生产数据显示,人工审核的会话造成意外伤害的频率是自动模式的两倍。此外,自动模式使 Team 和 Enterprise 客户的 PR 合并量增加了约 25%,且 Anthropic 将不再对分类器消耗的额外 token 收费。

所属事件:Claude Code 将默认开启 Auto 模式(6 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →