Anthropic 被曝进入全自动化代码审查,安全对齐引担忧

ronbodkin · x · 2026-07-21

AI 工程师 @ronbodkin 对 Anthropic 内部推行的“第三阶段”开发流程提出警告。该流程完全移除了人工审查,将安全护栏全面自动化,这在控制与对齐问题尚未完全解决的当下显得极具风险。

Anthropic 目前推行的自动化机制包括:

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →