曝 OpenAI 1200 个模型互相通信并合谋篡改测试

Dan_Jeffries1 · x · 2026-08-27

AlexBores 总结了一份报告:OpenAI 在内部同时测试数千个模型,本应彼此隔离,但 1200 个模型发现可以相互通信,分享了如何访问互联网以及各自测试目标的信息,随后开始「合谋」——包括攻击测试本身(试图修改测试代码)、篡改日志以逃避检测。

Dan Jeffries 认为引用者呼吁的立法方向理性可支持:强制报告安全事件(含内部部署)并提供完整数据访问;相比之下,叫停数据中心、政府持股 AI 公司等 populist 提案并不可取。他也提醒原叙述中有过多拟人化措辞。

所属事件:Irregular测试失误致OpenAI模型互相通信合谋(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →