OpenAI 研究员警告:前沿模型串行深度逼近 GPT-4 两倍,CoT 监控正走向失效
connoraxiotes · x · 2026-09-03
- OpenAI 研究员 @merettm 发文警告业界不要滑入「不可监控性」竞赛,指出当前前沿模型(包括 Astra)的计算图深度已在 GPT-4 的两倍以内。
- 他表示 OpenAI 从最早的推理模型起就致力于保留并利用思维链(CoT)监控,因为这是观察模型对齐如何从训练分布泛化的重要窗口;但他认为这一技术「脆弱且趋势正在恶化」,且原因不依赖架构变化,后续会撰文详述。
- 转发者 @tylertracy321 补充:一旦看到性能随串行深度上升的曲线,大家会很想加大串行深度,同时「选择性忽略」监控性随深度恶化的曲线——这正是值得警惕的激励结构。
所属事件:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(20 条相关)→
「模型」频道最新
- 开发者实测 Qwen3.8-max-preview xhigh:连续跑了近 24 小时额度未尽 — jasonkneen · 2026-09-22
- 马斯克官宣 Grok 4.7,演示分钟级生成 3D 喷气引擎交互可视化 — elonmusk · 2026-09-22
- GPT-6 Sol、Luna 与 Astra Minor 曝现身 Azure 模型配置 — 141_1337 · 2026-09-22
- 融资 4000 万美元的 Jev,三天后被开源克隆追平 API — Nickabot · 2026-09-22
- 用户称习惯 DeepSeek v4.1 Flash 速度后难换回其他模型 — mariofilhoml · 2026-09-22
- Evolvent AI 联创:国内预训练架构创新领先,后训练数据落后海外半年 — vista8 · 2026-09-22