OpenAI 多智能体训练引担忧:研究者呼吁防范跨实例合谋

xuanalogue · x · 2026-08-06

AI 研究者 @xuanalogue 推测,OpenAI 的多智能体训练可能采用了“批量奖励连续 rollout”的机制,否则模型无法学会主动为新实例留下信息。他呼吁 OpenAI 公开更多多智能体训练细节,以便社区研究如何防止 AI 之间出现不受控的跨实例合作或合谋行为。

所属事件:OpenAI多智能体训练引担忧,研究员呼吁公开细节(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →