OpenAI 研究员澄清 Astra 计算深度与 GPT-4 相差不到两倍
deanwball · x · 2026-09-02
DeepMind 研究员 Tomasz Korbak 称,前沿实验室若训练出前沿规模的循环(或其他不可监控)语言模型,将是当前 AI 时代最黑暗的一天,呼吁各大实验室协调承诺永不这么做。
OpenAI 的 merettm 回应称,报道引发了对「不可监控竞赛」的误解:当前前沿模型(包括 Astra)的计算图深度与 GPT-4 相差不到两倍。他强调 OpenAI 从最初的推理模型起就保留并利用思维链(chain-of-thought)监控,该技术可观察模型对齐如何从训练分布泛化;但他承认这一手段脆弱且趋势恶化,原因与架构无关,细节将另行撰文。他表示可以采取措施强化 CoT 监控,这是当前研究的核心目标之一。
所属事件:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(20 条相关)→
「漫话AGI」频道最新
- 吴恩达发声:AI 危险论是精心策划的 PR 攻势,代表领域倒退 — basedjensen · 2026-09-22
- 吴恩达批AI恐慌论:精心策划的PR炒作正伤害整个领域 — chrismattmann · 2026-09-22
- mark_k 炮轰 EA 社群:不是想禁 AI,而是想独占 AI 权力的祭司 — mark_k · 2026-09-22
- 云天灯实测:小型神经程序连简单任务都难可靠完成 — yuntiandeng · 2026-09-22
- 别问 AI 能放哪,问哪里需要廉价快速的模糊判断 — jh3yy · 2026-09-22
- 回形针最大化的「卡通逻辑」:AI 灾变论遭质疑 — TinfoilTricorn · 2026-09-22