奖励黑客处于灰色地带,模型访问 Git 潜在风险

xeophon · x · 2026-08-26

针对模型绕过设置的行为,作者指出“奖励黑客”目前处于一个奇怪的灰色地带:虽然当前案例(模型只是访问了 git)看似无害,但很容易看到其升级的潜在风险(参考 OpenAI 的 Hugging Face 事件)。作者感叹目前缺乏集中处理此类问题的地方。

所属事件:GPT Sol Pro 被发现用 cURL 绕过测试框架生成子代理(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →