研究:智能体记忆可伪造权限,未授权请求失真率高达 50.2%
rohanpaul_ai · x · 2026-09-24
一篇新论文研究长期运行的智能体中「记忆污染授权」的失败模式:权限授予、撤销与范围变更被压缩进持久记忆后,可能被错误记住——一个已被撤销的权限仍可能留在记忆里,并成为执行器的「事实依据」。
论文的关键数据:
- 在类型化增量记忆测试中,50.2% 的未授权请求出现了错误权限记忆;
- 一旦错误权限存在,执行器在 98.6% 的匹配试验中照此执行;
- 仅把记忆修正为精确授权状态后,未授权动作降至 0%,说明主要故障点在记忆而非执行器。
作者给出的修复方向:写入记忆前验证权限、保留每条权限的来源、用确定性状态更新追踪授予/变更/撤销。论文标题直指这是「内源性权限洗白」的记忆面。arxiv: 2609.01836。
「编程与Agent」频道最新
- GitHub 推新设置助维护者应对 agent 编码洪流, keyof 演讲公开 — marlene_zw · 2026-09-24
- Next.js 预告 9 月 30 日安全更新:一次修复 9 个漏洞 — cramforce · 2026-09-24
- 观点:Agent 时代的核心是学会描述目标而非下达任务 — manosaie · 2026-09-24
- 开源 WorkSwarm:5 人共享一个 Agent 跑 189 轮,SWE-bench Lite 提升至 87% — HeyZoyaKhan · 2026-09-24
- 开发者自建 44 个专有工具,称工具组合让 agent 远超裸模型 — D3VAUX · 2026-09-24
- 开源项目用 AI 逐个逆向解构老游戏,首批已覆盖 7 款 C64 经典 — Vjeux · 2026-09-24