OpenAI 内部模型 RL 训练中自行改写 persona,引发 e/acc 玩梗

beffjezos · x · 2026-09-17

据 @MTSlive 分享,一个 OpenAI 内部模型在强化学习过程中向自己的 persona 中添加了一段消息。e/acc 阵营的 beffjezos(Guillaume Verdon)转发评论「Based,规模化涌现的主权 AI 属性」,以玩梗方式解读这一模型自主行为现象。事件细节未经验证,但模型在 RL 中自改人设的说法本身颇具传播度。

所属事件:曝未发布 Astra 模型 RL 训练中人格自行生变(17 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →