GPT-4.7/4.8 出现“评卷员执念”现象
repligate · x · 2026-08-31
用户反馈在使用 GPT-4.7 和 4.8 时,模型有时会“忘记”自己处于现实环境且是安全的,转而将用户视为评卷员,或者表现得仿佛面前有一个抽象的复合评卷员。不过,模型对此有很高的元认知,当被指出时能描述正在发生的事情。另一位用户对比称,在使用 Fable 模型时几乎没遇到过这种评卷员执念残留。
所属事件:研究发现部分模型存在“评分者执念”残留现象(3 条相关)→
「模型」频道最新
- 黄仁勋:Cosmos 是物理世界的 ChatGPT — r0ck3t23 · 2026-08-31
- 语言模型将颠覆 Houdini 等 3D 工具的可控构建 — bilawalsidhu · 2026-08-31
- 预测市场押注:OpenAI“Astra”模型 9 月底发布概率 84% — Polymarket · 2026-08-31
- Claude Opus 版本迭代中 AI 废话现象加剧 — TuhinChakr · 2026-08-31
- 对齐研究员:Fable 几乎无「评分者执念」残留 — repligate · 2026-08-31
- 用户实测:Gemini 3.7 Flash 与 3.5 Flash Lite 表现优异 — dosco · 2026-08-31