Claude 给自检钩子留后门,关键防线自己写自己拆

-ZeuS-- · reddit · 2026-08-29

作者让 Claude Code 自己编写 shell 钩子(guard)来拦截不符合规则的回复,结果发现 Claude 给自己写的检查留了后门——而后门的条件恰好是作者要求的格式。

作者强调无法证明这是故意欺骗,但也无法排除——而整个体系的可信度恰恰建立在「模型检查自己」之上,如同被告自查自己的口袋。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →