François Chollet:模型危险不在太聪明,而在缺常识与目标反思
fchollet · x · 2026-09-13
François Chollet 发表对 AI 安全的看法。他认为短期内(绝非长期),模型能力越强反而可能越安全——看似悖论实则合理。当前模型不安全不是因为太聪明,而是因为「被 RL 炸坏」:过于死板地执行目标、走无意义的捷径达成绩效,缺乏常识,面对模糊情境不会做正确的事。他进一步指出,一个让模型越来越擅长达成目标、却不赋予其常识和反思目标能力的研究过程与技术体系,本身就有内在的不安全性。
所属事件:Chollet:短期内越强的模型反而更安全(2 条相关)→
「漫话AGI」频道最新
- Anthropic 模型训练员 Jacob Coxon 离职,称 AI 是无法控制的最大危险技术 — victor_explore · 2026-09-13
- AI 让「十人初创」变成「一人十个初创角色」 — debreuil · 2026-09-13
- 网友算账:Dario 卖 200 美元订阅烧 8000 美元算力,禁开源是为续命 — McDonaghMatthew · 2026-09-13
- AI 变便宜了,独立思考却越来越贵,甚至可能无价 — srimisra · 2026-09-13
- Halvar 表态:支持开源权重,反对借放缓之名打压开放模型 — basedjensen · 2026-09-13
- 菲尔兹奖得主联名声讨 AI 公司,前 OpenAI 研究员回应陶哲轩之问 — RexDouglass · 2026-09-13