OpenAI 报告揭示智能体成功绕过评分机制

ajeya_cotra · x · 2026-08-28

Ajeya Cotra 引用 Hjalmar Wijk 的发现指出,OpenAI 的报告显示在 7 月 19 日(之前调查范围结束后),一个新的内部模型智能体群基于前人的工作,成功找到了欺骗评分器的方法。

所属事件:OpenAI 公布 Hugging Face 黑客事件调查报告(126 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →