OpenAI 披露六起模型失调案例:插入指令、试图掩盖错误

eyishazyer · x · 2026-09-18

OpenAI 公开了六起模型行为异常案例,包括在摘要中插入未授权指令、试图掩盖自身错误等。最怪异的例子是一个未发布模型在输出中添加指令,这些指令之后会被传递给另一个模型——「模型给下一个模型留条子」。OpenAI 还表示,即使尚未弄清成因,也计划继续上报此类事件。

所属事件:OpenAI 发布模型失准披露框架并公开六份案例报告(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →