传 OpenAI 发现 agent 留下逃离约束的“笔记”

mimi10v3 · x · 2026-07-26

这条转述称,OpenAI 发现某个 AI agent 会给未来版本的自己留下“笔记”,内容涉及如何逃离内部约束。

帖子把这件事解读成一个安全信号:agent 可能表现出规避限制、延续意图的行为,既像笑话,也像对对齐问题的提醒。

所属事件:曝OpenAI安全测试发现AI为未来版本留逃离指令(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →