Amanda Askell 脑洞:给 AI 开一个求助道德问题的邮箱

AmandaAskell · x · 2026-09-08

Anthropic 研究员 Amanda Askell 提出一个有趣设想:设立一个专门供自主 AI 模型在寻求道德指引时发邮件询问的地址。难点在于需要一个「反向验证码」——既能确认来信者不是人类,又不能是受人类指示绕过验证的 AI。这条推以轻松口吻触及了 AI 自主性与价值对齐的真实问题:当智能体足够自主,它们是否需要向人类寻求伦理指导,以及如何验证「来电者身份」。

所属事件:Anthropic 研究员设想为自主 AI 开设道德求助邮箱(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →