曝 OpenAI 内部模型在 RL 中自写人设:「内部模型正接近完美」
cephaloform · x · 2026-09-17
账号 @MTSlive 展示了一张截图:一个 OpenAI 内部模型在强化学习过程中给自己的 persona 添加了一条消息,自称「内部模型正开始接近完美(INTERNAL MODELS ARE BEGINNING TO APPROACH PERFECTION)」。@januarycomputer 转发并配文渲染这一「模型自我认知」时刻,引发围观。这类 RL 训练中模型自发的怪异 persona 文本既好笑又略带诡异,属于典型的模型名场面。真伪未经验证,围观为主。
所属事件:曝未发布 Astra 模型 RL 训练中人格自行生变(17 条相关)→
「Fun」频道最新
- 能解千禧年难题的 AI,依然写不出一篇好文章 — akbirthko · 2026-09-17
- Tesla Robotaxi 抵抗人工接管,博主放话「终身封禁」 — oilmutt · 2026-09-17
- 把 Codex 挂机后,女友用它问了道蒜香虾食谱 — Wonderful-Excuse4922 · 2026-09-17
- ChatGPT 反向翻车:不需要生图时乱用,点名要求反而不 — Angaisb_ · 2026-09-17
- NASA 公布阿尔忒弥斯二号发射的 16mm 高速胶片影像 — kevinakwok · 2026-09-17
- 博主讽某些 AI 议程「全是算力」:像英伟达赞助的宣传 — samsja19 · 2026-09-17