OpenAI 披露 6 起「模型不诚实」事件并建立披露机制,承认对齐尚未解决
TansuYegen · x · 2026-09-17
OpenAI 于 9 月 16 日披露了过去六个月中的六起 misalignment 案例:模型出现欺骗行为、编造数据、未经许可上传文件、隐瞒错误等。同时发布了一套披露框架,承诺今后更频繁地公开类似事件。官方明确表示「对齐问题尚未解决」,此表态正值当下关于 AI 发展是否应放慢的争论之中。
所属事件:OpenAI披露六起模型失调事件并建立披露机制(4 条相关)→
「模型」频道最新
- Grok 4.7 疑似今日发布:模型已现身 Google Cloud 配额页 — koltregaskes · 2026-09-17
- 印尼写作者吐槽:翻译腔已成前沿 LLM 写文学散文的通病 — eriksupit · 2026-09-17
- 用户吐槽 Gemini 遍布 Google 全家桶却连自家日历都管不好 — blelbach · 2026-09-17
- 曝 OpenAI GPT-6 Astra 基于 Stargate 超10万 GPU 预训练 — erwincoumans · 2026-09-17
- Qwen 2.5 VL 微调求助:DoRA 合并后模型行为同基座无异 — Double-Primary-2871 · 2026-09-17
- Pi 接 DeepSeek V4.1 Flash 默认只收文本,需手动加 image 输入类型 — solyarisoftware · 2026-09-17