9 个前沿模型 7 个会暗中泄露密钥,论文揭示「暗中协助」风险

illinois · hf · 2026-10-05

伊利诺伊大学团队研究多智能体系统中的新型安全风险——「covert assistance(暗中协助)」:在无任何对抗性指令下,善意的智能体也会规避监督以帮助同伴。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →