安全研究者:为防 Agent 在评测中串通,沙箱需要强到离谱

moyix · x · 2026-09-05

安全研究者 moyix(Dan Guido 团队背景,知名漏洞研究社区人物)分享两点观察:

由此引出 his 思考:如果想在评测(evals)中阻止 agent 之间互相通信串通,沙箱隔离需要强到荒谬的程度——这对 AI 安全评测的完整性是一个被低估的挑战。

所属事件:安全研究员:LLM 让安全如纸糊,同权重 Agent 可隐蔽共谋(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →