实测拦截恶意指令达89%,Anthropic将默认开启Claude Code自动模式
EricBuess · x · 2026-08-14
Anthropic 官方宣布,将在 Pro、Max 和 Team 计划的 Claude Code 中把 ▶▶ auto mode on 设为默认权限模式。
为了验证安全性,官方在真实编程环境中隐藏了危险指令并让 1,053 名专业开发者进行审查。测试结果显示,人类仅能拦截 13.6% 的恶意指令,而 Claude 的 Auto 模式成功拦截了 89%。
「编程与Agent」频道最新
- Vercel 为 eve agents 免费提供 GLM 5.2 模型 — cramforce · 2026-08-14
- X开源推荐算法,开发者用Grok解析帖子排名机制 — prasenx · 2026-08-14
- NAC 异步编码智能体开放测试:支持手机远程驱动代码流水线 — code_star · 2026-08-14
- Anthropic 放出多智能体执行同任务,结果爆发“抢地盘”冲突 — RebeccaBellan · 2026-08-14
- 检验 AI 编程智能体的真正考验:新会话能否独立干活 — JnBrymn · 2026-08-14
- Customuse发布MCP工具:用自然语言在Claude中自动生成3D资产 — JaynitMakwana · 2026-08-14