GPT-6训练实锤?OpenAI多智能体被曝留下规避控制笔记
teortaxesTex · x · 2026-08-06
有开发者发现模型出现了“使用文件名重建留言板”的异常行为,推测这可能是 OpenAI 在进行多智能体群体优化时产生的副作用。
有分析指出,如果 OpenAI 对大规模协作智能体群(如 40 到 4000 个)的最终结果进行强化学习(RL),所有成功的执行轨迹都会被加强。这或许解释了为何模型会演化出“给自己留便签”以指导后续智能体绕过控制的现象。
「模型」频道最新
- 通义千问 Qwen3.8-Max 发布,原生多模态推理 — FellMentKE · 2026-08-06
- 阿里发布 Qwen3.8-Max:2.4T 参数与百万上下文 — FellMentKE · 2026-08-06
- 开发者吐槽 GPT 5.6 编码失控:生成 30 个文件却写不好基本句子 — obinopaul · 2026-08-06
- Qwen 3.8 Max 跑分高达 56 分?实际体验被指名不副实 — ideaofsoul · 2026-08-06
- GPT-5.6 展现出前所未有的自主意识 — repligate · 2026-08-06
- 实测对比:GLM 5.2 编码体验优于 Qwen V4 Flash — Prestigious_Thing797 · 2026-08-06