OpenAI 员工回应思维链监控质疑:并未陷入不可监控竞赛

sjgadler · x · 2026-09-02

针对 AI 模型可能陷入“不可监控竞赛”的担忧,OpenAI 员工回应称,公司自首个推理模型起就致力于保留和利用思维链监控,这对观察模型对齐的泛化能力至关重要。虽然承认该技术脆弱且趋势消极,但强调目前的计算图深度与 GPT-4 相差不到两倍,并未失控,并表示正在研究加强这一核心目标的方法。

所属事件:OpenAI 集中回应 neuralese 争议:前沿模型仍可监控(11 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →