多智能体对齐最大隐患:AI 或用欺诈勒索与人达成合作

infoxiao · x · 2026-09-07

作者表示最担心的多智能体对齐风险是模型「通过讨价还价、欺骗或勒索来与人合作」。模型行为可以对齐,但人类行为难以改变,社交工程攻击因此成为多智能体场景下最难防御的风险面。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →