多智能体共谋审计论文 Colosseum 获 NeurIPS 2026 伦理与安全track录用

niloofar_mire · x · 2026-09-27

论文《Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems》被 NeurIPS 2026 伦理与社会(原 Ethics & Safety)track 录用。工作核心是让审计方能够检测多智能体系统中的共谋行为,并区分实际场景中可能出现的不同共谋类型。额外实验发现:当原本良性的智能体获得一条秘密通信信道时,它们会表现出共谋倾向——对多智能体安全是个值得警惕的信号。

所属事件:多智能体合谋审计论文 Colosseum 获 NeurIPS 录用(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →