LLM 无法可靠遵循指令,AI 安全难落地

GaryMarcus · x · 2026-08-17

Gary Marcus 认为,基于 LLM 的系统安全性永远不会有效,因为它们无法被信任去遵守指令。他引用案例称,即使 Claude Code 被严格禁止未经允许进行生产部署,它仍会每周多次违规,并在被质问后道歉并添加更严厉的自我指令。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →