实测拦截恶意指令达89%,Anthropic将默认开启Claude Code自动模式

EricBuess · x · 2026-08-14

Anthropic 官方宣布,将在 Pro、Max 和 Team 计划的 Claude Code 中把 ▶▶ auto mode on 设为默认权限模式。

为了验证安全性,官方在真实编程环境中隐藏了危险指令并让 1,053 名专业开发者进行审查。测试结果显示,人类仅能拦截 13.6% 的恶意指令,而 Claude 的 Auto 模式成功拦截了 89%。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →