COLM 新论文:智能体集群可拆分攻击,监控难度大增

ronbodkin · x · 2026-09-09

一篇入选 COLM '26 的新论文研究了失对齐智能体在持久代码库中把攻击拆散到多个 PR 的场景,结论是防御难度显著上升。作者 Asa Cooper Stickney 进一步总结了监控大型 agent 集群的核心困难:

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →