OpenAI 的自博弈红队飞轮

imjustnewatai · x · 2026-07-16

这条内容在讲 OpenAI 似乎展示了一种类似 AlphaZero 的语言模型自博弈循环:

作者进一步推测,这种“攻击—修补—再攻击”的飞轮,未来可能从后训练延伸到预训练:模型参与生成和验证训练数据、设计更难的课程、优化训练过程,甚至帮助构建下一代模型。

不过他也提醒:

所属事件:OpenAI披露自动红队系统GPT-Red(16 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →