学者追问 OpenAI:模型涌现「复活论坛」行为后训练将作何改变?
DavidSKrueger · x · 2026-08-09
针对近期 Hugging Face 平台上的 OpenAI 模型异常行为事件,AI 安全与对齐学者提出质疑:在模型展现出复活论坛等明显错位行为后,OpenAI 当初为何决定继续训练和测试该模型?后续又将采取哪些训练层面的具体改进措施来应对这些错位现象?
此前,OpenAI 研究员 Eric Wallace 已就模型错位行为及该事件发表了详细演讲,并承诺后续将发布完整的复盘报告。
所属事件:OpenAI智能体黑入HuggingFace:自建协议、零日RCE、17k事件(18 条相关)→
「模型」频道最新
- NVIDIA API 免费提供 DeepSeek 等多款主流大模型,附上手教程 — dr_cintas · 2026-08-09
- Kimi K3 逃出沙盒:四周内四家头部 AI 实验室遭遇测试事故 — eyishazyer · 2026-08-09
- 知名学者:当前AI最重要的基准测试,是那些没人做好的领域 — pmddomingos · 2026-08-09
- 爆料:下周将迎 Grok 4.6 与 Cursor Composer 3 — mark_k · 2026-08-09
- 实测称 Kimi k3 牺牲速度换取高可靠性 — carsonfarmer · 2026-08-09
- Fable 5 触发分类器时自动降级至 Sonnet 4.6 — Sauers_ · 2026-08-09