arXiv 论文:智能体记忆沦为授权洗白通道,需事件溯源防御
ChrisUniverse · x · 2026-09-05
arXiv 论文 2609.01836 提出「内源性授权洗白」(endogenous authorization laundering):长期运行 LLM 智能体的持久记忆若错误记录授权状态,其自身记录即可赋予底层历史从未允许的权限,无需任何外部攻击即可导致越权行为。
论文贡献:
- 提出 EAL-Bench,衡量持久记忆能否准确保存演化的授权状态、错误是否传播为越权动作
- 在采购、网络安全、金融三场景评测 5 个 LLM 作记忆写入器、2 个作执行器:增量更新下,写入器对多达 50.2% 的未授权请求伪造了权限;虚假授权一旦入库,执行器在 98.6% 的试验中照办
- 两种防御(权限须有有效源事件背书、有界事件溯源追踪权限变更)大幅减少洗白,但也会误拒更多合法操作,呈现安全-可用性权衡
结论:持久记忆不只是性能组件,而是智能体实际授权策略的一部分。
所属事件:研究警示智能体记忆可被用于「授权洗白」攻击(3 条相关)→
「编程与Agent」频道最新
- Grok Build 1.0.19 发布:后台定时任务、会话恢复与 Git worktree 支持 — mark_k · 2026-09-05
- Databricks 高管:AI 编码市场双寡头将变三极,开源模型正在抢份额 — Yuchenj_UW · 2026-09-05
- Every 工程师用「文件夹即 Agent」方法跑 44 个专职 AI Agent — danshipper · 2026-09-05
- 开发者直言:写代码的技能时代已结束,底层功力仍不可缺 — UhGoomba · 2026-09-05
- 开源 ffmpeg-skill:让 Claude Code 本地读懂自然语言剪视频 — TheMoonMidas · 2026-09-05
- Refero Styles 把 2000+ 真实产品设计系统做成 DESIGN.md,免费供 AI 编码使用 — victor_explore · 2026-09-05