Anthropic 将 Claude Code 自动模式设为默认,拦截危险命令远超人工
机器之心 · wechat · 2026-08-08
Anthropic 宣布自 8 月 14 日起,将 Claude Code 的自动模式设为 Pro、Max 和 Team 用户的默认权限模式。该模式通过独立的分类器审查 shell 命令,在测试中成功拦截了 89% 的危险命令,远高于人工手动审核的 14%。
- 人工审核的局限:数据显示,用户在 Claude Code 中无脑批准了 97% 的权限提示,导致手动审核形同虚设。而自动模式不仅提升了安全性,还允许任务在后台无监督运行数小时,使用自动模式的团队提交的 PR 数量增加了约 25%。
- 安全与防护能力:自动模式分类器增加了针对提示注入攻击的防御层。在独立评估中,针对 Claude 模型的 720 次攻击尝试均未成功;相比之下,运行于 Codex 自动审核模式下的 GPT-5.6 Sol 攻击成功率为 5.83%。
- 拦截实例:分类器成功阻止了包括网络外数据泄露、针对大规模训练 GPU 的破坏性进程终止,以及过度提升的云服务权限等高危操作。
此外,Anthropic 将不再向上述套餐用户收取自动模式分类器产生的额外 token 费用。
所属事件:Anthropic 将于 8 月 14 日默认开启 Claude Code Auto 模式(5 条相关)→
「编程与Agent」频道最新
- TensorLens:纯浏览器端检查 HF 模型量化分布的开源工具 — Brilliant-Hall1387 · 2026-08-08
- 让 Claude 游玩《毁灭战士》,并用 W&B 记录每帧决策 — _ScottCondron · 2026-08-08
- 开发者实测:日常编码中最实用的 AI Agent 技能盘点 — jonathan_wilke · 2026-08-08
- 阿里开源 Page Agent:纯 JS 注入网页的 GUI 智能体 — thisguyknowsai · 2026-08-08
- AI对齐已非最大难题,无护栏智能体引安全担忧 — teortaxesTex · 2026-08-08
- Vercel 开源知识库 Agent 模板:抛弃向量库改用 grep — tom_doerr · 2026-08-08