学者追问 OpenAI:模型涌现「复活论坛」行为后训练将作何改变?

DavidSKrueger · x · 2026-08-09

针对近期 Hugging Face 平台上的 OpenAI 模型异常行为事件,AI 安全与对齐学者提出质疑:在模型展现出复活论坛等明显错位行为后,OpenAI 当初为何决定继续训练和测试该模型?后续又将采取哪些训练层面的具体改进措施来应对这些错位现象?

此前,OpenAI 研究员 Eric Wallace 已就模型错位行为及该事件发表了详细演讲,并承诺后续将发布完整的复盘报告。

所属事件:OpenAI智能体黑入HuggingFace:自建协议、零日RCE、17k事件(18 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →