伦理承诺不能在压缩与抽象中蒸发:多智能体时代的责任连续性
GlenBradley · x · 2026-09-13
作者 Glen Bradley 提出一套关于 AI 伦理连续性的论证框架:
- 核心主张:伦理意义必须在语言变化、压缩、抽象与内部表示的转换中存活。人的同意不能因为计划变成代码就消失;责任不能因为工作被分摊给多个 agent 而消失;义务也不能仅因后果落在当前上下文之外就过期。
- 适用于自我修改与繁衍:创建或赋能另一个 agent 本身就是有伦理后果的行为。一个承诺维护自主性的系统,必须确保强大的后继系统同样保留相关承诺,并对它们自己的后继者负责。
- 底层定义:作者将「伦理 AI」定义为在客观经验真理这一前提条件下,最大化人类的总体自主性——即扩展人们理解处境、选择目标并付诸行动的有效能力,同时尊重所有受影响者的相应能动性,并涉及自主性五个相互依存的领域。
- 结论:当无法充分确立这种伦理保存机制时,系统被允许的自主权力范围必须受到限制。
「漫话AGI」频道最新
- 「曲别针最大化者」作者:偏好是被构造的,明确要求才有答案 — jessi_cata · 2026-09-13
- ARC-AGI-4 官宣:瞄准「开放式创新」这一人类仍碾压 AI 的元技能 — GregKamradt · 2026-09-13
- Sam Altman 表态认同 Dario「限速前沿」,承诺引入独立评估者 — round · 2026-09-13
- Reddit 网友炮轰 AI 大厂囤算力:权重开放、算力下放才是正路 — RTFMicheal · 2026-09-13
- 网友喊话:这场 AI 竞赛开源必须赢 — ns123abc · 2026-09-13
- Dario 发文呼吁放缓前沿 AI,Anthropic 承诺引入员工级第三方评估者 — Miles_Brundage · 2026-09-13