Anthropic 被曝进入全自动化代码审查,安全对齐引担忧
ronbodkin · x · 2026-07-21
AI 工程师 @ronbodkin 对 Anthropic 内部推行的“第三阶段”开发流程提出警告。该流程完全移除了人工审查,将安全护栏全面自动化,这在控制与对齐问题尚未完全解决的当下显得极具风险。
Anthropic 目前推行的自动化机制包括:
- 自动代码审查与安全审查
- 智能体沙盒化
- 使用 CLAUDE.md 和 Skills 编码执行标准
- 根据团队使用情况微调 Auto 模式分类器
- 通过模型选择、 advisors、LSPs 以及拆分 CLAUDE.md 为 lazy Skills 来管理 Token 消耗
「编程与Agent」频道最新
- 智能体自治别急着放权,先跑波次找摩擦点 — JnBrymn · 2026-07-22
- Coding agents 正走向 AI 写、AI 审、人工批的流程 — aftahi_ai · 2026-07-22
- oMLX 0.5.2 增加菜单栏统计和低比特解码内核 — awnihannun · 2026-07-22
- GitHub 机器人审到上限,PR 还要等 39 分钟 — DanielLockyer · 2026-07-22
- Codex Remote 的 Max 推理强度疑似只在移动端开放 — GabGarrett · 2026-07-22
- 有人用 MCP 做了个 demo,主张商店应把价格和购物车开放给 AI — gelembjuk · 2026-07-22