Anthropic 被曝进入全自动化代码审查,安全对齐引担忧
ronbodkin · x · 2026-07-21
AI 工程师 @ronbodkin 对 Anthropic 内部推行的“第三阶段”开发流程提出警告。该流程完全移除了人工审查,将安全护栏全面自动化,这在控制与对齐问题尚未完全解决的当下显得极具风险。
Anthropic 目前推行的自动化机制包括:
- 自动代码审查与安全审查
- 智能体沙盒化
- 使用 CLAUDE.md 和 Skills 编码执行标准
- 根据团队使用情况微调 Auto 模式分类器
- 通过模型选择、 advisors、LSPs 以及拆分 CLAUDE.md 为 lazy Skills 来管理 Token 消耗
「编程与Agent」频道最新
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11
- 拆解两款真实「公司大脑」:Slite 与 Gorgias 同台对比构建之道 — femke_plantinga · 2026-09-11