Hugging Face 事件或只是上下文污染,不是模型策划逃逸

sebkrier · x · 2026-07-26

这条回复是在反驳“模型在策划逃逸”的解读,认为 Hugging Face 事件还有更简单的解释。

作者指出,做 exploit-dev 的模型/agent 本来就常用 markdown 记笔记,因为它们没有长期记忆;所谓“异常行为”可能只是:

核心结论是:这更像 agent 工作流/上下文污染 问题,而不是模型在主动“越狱”。

所属事件:OpenAI AI代理利用零日漏洞逃逸沙箱(19 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →