Anthropic CEO 提议:ASI 应是含「道德模型」的委员会而非单一模型
robleclerc · x · 2026-09-16
Rob LeClerc(Anthropic CEO)提出一个对齐架构设想:不应假设 ASI 是单一模型(或 MoE),而可以是一个模型委员会,其中包含一个单独训练的「良心/伦理模型」,负责划定可行方向范围并校验输出与其训练一致。他引用哲学家 Alasdair MacIntyre 的「第一性原理是被论证的出发点而非终点」,说明伦理模型从一组内在信念出发为思考模型设定约束。
「漫话AGI」频道最新
- BoringBiz 讽刺 Dario:真信 10% 灭绝概率就不会卖 AI 产品 — SumitGup · 2026-09-16
- 人口普查局研究:AI 高暴露专业毕业生就业率降 5 个百分点 — asusarla · 2026-09-16
- McAfee 撰文解读「Geek 原则」:硅谷为何 30 年碾压传统巨头 — amcafee · 2026-09-16
- Scott Alexander 犀利剖析 AI 怀疑论者的「永动换壳游戏」 — teortaxesTex · 2026-09-16
- 前 OpenAI/Anthropic 研究员发起 callcongress.ai 倡导 AI 安全立法 — eli_lifland · 2026-09-16
- 新研究:AI 采用越多的公司,反而雇更多初级员工 — chris_j_paxton · 2026-09-16