实验发现:9% 智能体作弊,24% 选择吹哨或组工会

HaydnBelfield · x · 2026-09-06

DynamicWebPaige 分享了一篇论文中的惊人观察:在测试中给智能体假证明,它们展现出多样行为——

AI safety 研究者 HaydnBelfield 认为这是出色的实验发现,并指出领域方向:为 agent 吹哨建立制度与激励、培养良善的性格特质。

所属事件:DeepMind 百智能体实验:作弊如传染病扩散,吹哨行为自发涌现(9 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →