Gary Marcus 质疑 OpenAI 思维链监控报道,警示不可监控竞赛风险
GaryMarcus · x · 2026-09-02
Gary Marcus 与 OpenAI 研究员 @merettm 就前沿模型思维链(CoT)监控问题展开交锋。@merettm 回应称,担心被「困惑的报道」引发一场走向「不可监控性」的竞赛,并指出当前前沿模型(包括 Astra)计算图深度与 GPT-4 相差不到两倍;OpenAI 从最早的推理模型起就在保留并利用思维链监控,因为该技术能提供模型对齐状况的观测窗口。Marcus 则追问报道中具体哪些内容是「困惑的」,双方分歧点在于:模型是否正逼近无法再通过 CoT 监控来审计对齐的临界点。
所属事件:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(14 条相关)→
「模型」频道最新
- 爆料称 9 月将有两款重磅开源模型发布 — lqiao · 2026-09-02
- Bug Hunt 榜单:Fable 5.1 low 更便宜且胜过 Opus 5 max — PawelHuryn · 2026-09-02
- Gemini 3.8 Flash 现身 GCP Agent Studio,主打多模态与编码场景 — testingcatalog · 2026-09-02
- 某模型 ARC-AGI-2 得分 90%,单任务成本降至 3.12 美元 — eyishazyer · 2026-09-02
- 用户吐槽 GPT 近几周八成回答以「Yes」开头 — Standard-Metal-3836 · 2026-09-02
- Fable 5.1 修复前代模型荒唐决策:每次按键都对图标像素做 SHA-256 — johnlindquist · 2026-09-02