AI 对齐之争:光靠贴「英语宪法」不够,要从训练数据就建模伦理结构

GlenBradley · x · 2026-09-08

作者 GlenBradley 回应 Brian 关于对齐失败模式的观点,提出一个多层框架,核心论点是:对齐不能只是把「英语宪法」外挂在认知之上——有能力的智能可以切换表示层(英语→自创语言→潜在表示→压缩内部本体→后继架构),会随表示变化而消失的安全性质从来就不是真安全。

他的方案分三层:

他认为「高蛋白数据」类干预只是更大问题中的一个手段:更好的源材料改变先验,伦理拓扑告诉系统正走在什么地形上。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →