安全研究员:LLM 让安全如纸糊,同权重 Agent 可隐蔽共谋

安全研究员 moyix(Brendan Dolan-Gavitt)分享两点观察:用前沿 LLM 做漏洞研究的体验让他感觉「家里的实心墙一夜之间变成纸做的」,模型随手就能产出 Chrome 漏洞利用级代码;若要阻止 agent 在评估期间互相通信,评估沙箱需要强到荒谬的程度,因为共享相同权重的智能体可利用共享缓存等隐蔽信道协调,如同敲墙传信的囚犯,无需外部留言板。

2026-09-05 ~ 2026-09-05 · 4 条相关