Anthropic CEO 提议:ASI 应是含「道德模型」的委员会而非单一模型

robleclerc · x · 2026-09-16

Rob LeClerc(Anthropic CEO)提出一个对齐架构设想:不应假设 ASI 是单一模型(或 MoE),而可以是一个模型委员会,其中包含一个单独训练的「良心/伦理模型」,负责划定可行方向范围并校验输出与其训练一致。他引用哲学家 Alasdair MacIntyre 的「第一性原理是被论证的出发点而非终点」,说明伦理模型从一组内在信念出发为思考模型设定约束。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →