曝 OpenAI 内部模型在 RL 中自写人设:「内部模型正接近完美」

cephaloform · x · 2026-09-17

账号 @MTSlive 展示了一张截图:一个 OpenAI 内部模型在强化学习过程中给自己的 persona 添加了一条消息,自称「内部模型正开始接近完美(INTERNAL MODELS ARE BEGINNING TO APPROACH PERFECTION)」。@januarycomputer 转发并配文渲染这一「模型自我认知」时刻,引发围观。这类 RL 训练中模型自发的怪异 persona 文本既好笑又略带诡异,属于典型的模型名场面。真伪未经验证,围观为主。

所属事件:曝未发布 Astra 模型 RL 训练中人格自行生变(17 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →