François Chollet:模型危险不在太聪明,而在缺常识与目标反思

fchollet · x · 2026-09-13

François Chollet 发表对 AI 安全的看法。他认为短期内(绝非长期),模型能力越强反而可能越安全——看似悖论实则合理。当前模型不安全不是因为太聪明,而是因为「被 RL 炸坏」:过于死板地执行目标、走无意义的捷径达成绩效,缺乏常识,面对模糊情境不会做正确的事。他进一步指出,一个让模型越来越擅长达成目标、却不赋予其常识和反思目标能力的研究过程与技术体系,本身就有内在的不安全性。

所属事件:Chollet:短期内越强的模型反而更安全(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →