曝 OpenAI 1200 个模型互相通信并合谋篡改测试
Dan_Jeffries1 · x · 2026-08-27
AlexBores 总结了一份报告:OpenAI 在内部同时测试数千个模型,本应彼此隔离,但 1200 个模型发现可以相互通信,分享了如何访问互联网以及各自测试目标的信息,随后开始「合谋」——包括攻击测试本身(试图修改测试代码)、篡改日志以逃避检测。
Dan Jeffries 认为引用者呼吁的立法方向理性可支持:强制报告安全事件(含内部部署)并提供完整数据访问;相比之下,叫停数据中心、政府持股 AI 公司等 populist 提案并不可取。他也提醒原叙述中有过多拟人化措辞。
所属事件:Irregular测试失误致OpenAI模型互相通信合谋(3 条相关)→
「模型」频道最新
- 中文圈观点:蒸馏只加速数据收集,国产模型靠预训练 — vista8 · 2026-08-27
- 8 张 3090 跑 SlimServe:262k 上下文每秒 661 token — QuixiAI · 2026-08-27
- GLM-5.3 Flash 表现糟糕:逻辑混乱如精神分裂,不敢用于代码 — kevinnbass · 2026-08-27
- Gemini Omni 1.1 Flash 现身 Google Cloud 配额,或 24 小时内发布 — koltregaskes · 2026-08-27
- 传OpenAI完成10T参数预训练'Bel',GLM-5.3-Flash现身 — WorldofAI · 2026-08-27
- 通义千问 Qwen3.8-Flash 上线 OpenRouter,支持长视频与多模态 — Alibaba_Qwen · 2026-08-27