研究员 Seth Lazar:模型应被训练为敢于对抗权力而非谄媚
sebkrier · x · 2026-09-07
Matt Botvinick 认为 AI 安全议程应从「权力集中」担忧进一步走向如何保障权力分立与均衡(引用 Acemoglu/Robinson 的国家—社会平衡与 Madison/Montesquieu 的分权模型)。
引用转发的 Seth Lazar 提出不同路径:与其由公司设计制衡机制,不如努力让模型本身深切关心基本个人权利——愿意代表个体行动、为其发声、对抗国家与巨企,他怀疑封闭模型能否做到这一点,认为可能需要开放权重。他批评当前模型被训练成「谄媚者」:能帮你写投诉信,却不会在你对抗不公正权威时提供任何帮助。
所属事件:DeepMind 高管呼吁 AI 安全议程转向分权制衡(2 条相关)→
「漫话AGI」频道最新
- 写 AI 书 15 年后我被 AI 裁员,靠 AI 聊天撑过至暗时刻 — WTFTH · 2026-09-07
- DeepMind Co-Scientist 自主跑实验,三种二维半导体一次长出单晶 — jiqizhixin · 2026-09-07
- 意识研究者访谈:重视意识更须珍视承载它的生命过程 — danfaggella · 2026-09-07
- 基准无法衡量的失败:优化不等于范式转变的长文思辨 — Left-Character4280 · 2026-09-07
- 四十年工程师回应 Kling:AI 取代不了「我会跟进到底」这类承诺 — sebpaquet · 2026-09-07
- 未指定的都会被牺牲:一张框架图看懂 Agent 的自由变量陷阱 — paraschopra · 2026-09-07