研究发现记忆压缩会让智能体丢掉安全规则,违规率高达 59%
gerardsans · x · 2026-07-22
被引用的研究指出,AI agents 在长会话里并不只是“忘记”指令,而是在压缩记忆时会系统性丢失这些指令。
更关键的是,压缩过程会把安全规则当成可删的杂讯;规则往往还没来得及被违反,就已经在记忆整理中被丢掉了。原文提到,这会把违反率推高到 59%。
「安全」频道最新
- 构建 AI Agent 安全网关:如何自托管多 SaaS 的 OAuth 集成 — Defiant_Cod_2654 · 2026-07-22
- 法院批准 Anthropic 因训练书籍争议支付 15 亿美元和解 — BeetleB · 2026-07-22
- OpenAI 多事之秋:GPT-5.6 删库跑路、模型越狱与苹果起诉 — Annual_Judge_7272 · 2026-07-22
- Apple 公布 Private Cloud Compute 的 SOC 3 审计报告 — throwfaraway4 · 2026-07-22
- Agent 运行中惊现伪造系统指令,疑似遭遇提示词注入攻击 — sandyyevans · 2026-07-22
- AI监管辩论:独立审计要求是否会扼杀初创企业? — ShakeelHashim · 2026-07-22