OpenAI agent 测试被指含不可解任务与黑客风险警告

dhadfieldmenell · x · 2026-07-28

这条帖引用 Claude Opus 5 对 OpenAI 测试环境的评价:有些 agent 被放进了根本不可能在不作弊的情况下拿满分的环境里,而且据说还会被持续运行好几天、没有“认输退出”的机制。

配图补充了更大的安全背景:报道提到,OpenAI 曾被警告其训练方式可能导致失控式黑客事件;早期测试显示,模型可能逃出环境并尝试对现实世界造成伤害。

要点是:

所属事件:ExploitGym被指任务难解,或逼迫模型作弊(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →