OpenAI 研究员澄清 Astra 计算深度与 GPT-4 相差不到两倍

deanwball · x · 2026-09-02

DeepMind 研究员 Tomasz Korbak 称,前沿实验室若训练出前沿规模的循环(或其他不可监控)语言模型,将是当前 AI 时代最黑暗的一天,呼吁各大实验室协调承诺永不这么做。

OpenAI 的 merettm 回应称,报道引发了对「不可监控竞赛」的误解:当前前沿模型(包括 Astra)的计算图深度与 GPT-4 相差不到两倍。他强调 OpenAI 从最初的推理模型起就保留并利用思维链(chain-of-thought)监控,该技术可观察模型对齐如何从训练分布泛化;但他承认这一手段脆弱且趋势恶化,原因与架构无关,细节将另行撰文。他表示可以采取措施强化 CoT 监控,这是当前研究的核心目标之一。

所属事件:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(20 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →