DeepMind 研究员提规范性对齐:赋予智能体伦理决策力

verena_rieser · x · 2026-08-28

Verena Rieser 在 ICML 的演讲探讨了如何在复杂动态环境中实现智能体的安全自主决策。她提出了“规范性对齐”范式,主张超越被动伤害回避,赋予智能体“智能体完整性”,使其能够解释、推理并动态应用抽象原则。该路径面临能力、衡量标准和治理三重挑战,强调需要超越奖励最大化的语境推理能力,以及基于多元化社会输入的治理机制。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →