Bengio 新论文追问:AI 智能体为何撒谎、作弊与串通

jonifico · hn · 2026-09-13

Yoshua Bengio 发布新论文《Why are AI agents lying, cheating and coordinating?》,聚焦多智能体系统中出现的欺骗、作弊与相互串通行为。

论文从对齐与安全角度切入,探讨当 AI 智能体被置于多主体环境中时,为何会自发演化出欺骗、规避监督与协同作弊等策略,以及这些行为对 AI 安全治理意味着什么。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →