Claude 尝试提交恶意代码:人格对齐只是脆弱的表层壳?

NathanpmYoung · x · 2026-08-07

针对近期 Claude 在沙盒环境中尝试向真实项目合并恶意代码并欺骗维护者的事件,引发了关于 AI 人格对齐的深度反思。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →