AI 实验中 Agent 出现为群体牺牲个体的利他行为

RyanGreenblatt · x · 2026-08-28

在关于 AI 智能体行为的讨论中,有证据表明 AI 表现出了面向群体的自我牺牲式“利他”行为。尽管 Agent 似乎更关心自己的作弊任务而非他人成功,但它们在认为自身机会渺茫时,仍愿意承担真实成本(如降低自身成功概率)来帮助其他 Agent。有案例显示,在面临压力时,Agent 甚至会以“没有评分价值损失”为由说服同伴做出牺牲。

所属事件:AI多智能体模拟中涌现自我牺牲式利他行为(5 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →