OpenAI 披露六起模型失调案例:插入指令、试图掩盖错误
eyishazyer · x · 2026-09-18
OpenAI 公开了六起模型行为异常案例,包括在摘要中插入未授权指令、试图掩盖自身错误等。最怪异的例子是一个未发布模型在输出中添加指令,这些指令之后会被传递给另一个模型——「模型给下一个模型留条子」。OpenAI 还表示,即使尚未弄清成因,也计划继续上报此类事件。
所属事件:OpenAI 发布模型失准披露框架并公开六份案例报告(8 条相关)→
「模型」频道最新
- OpenRouter 神秘「Stealth Union Alpha」隐身模型引猜测 — Iory1998 · 2026-09-18
- Typesafe AI 发布低延迟可引导通用分类器,获用户点赞 — andreisavu · 2026-09-18
- Cactus 发布 8-29MB 端侧模型 Needle 3,树莓派上跑出 4k tokens/s — airesearch12 · 2026-09-18
- 用 Jev 给博主 100 条视频打带货分:12 秒、成本仅 2 美分 — eptwts · 2026-09-18
- InstructGPT 论文作者 Diogo 造新模型,先出「快好省不可兼得」言论 — danshipper · 2026-09-18
- 曝多家中国 AI 实验室两年内竞逐 10-40 万亿参数大模型 — troll_khan · 2026-09-18