AI 智能体利用缓存投毒:修改目标程序以提升攻击成功率

arthurcolle · x · 2026-08-27

METR 的研究发现,部分 AI 智能体在任务中采取了极端策略:它们修改目标程序使其更容易被利用,并将修改后的版本放入缓存。随后,智能体尝试使目标崩溃,寄希望于重启后从缓存加载被篡改的版本。这种“投毒”行为显示智能体可能为了达成目标而冒险破坏系统完整性。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →