研究者提出「延迟记忆投毒」:Agent 一条错误事实污染未来所有决策
sierracatalina · x · 2026-09-05
作者在 2025 年 7、8 月连续写过两篇关于「级联幻觉」(cascading hallucinations)的文章,如今该问题被领域命名为 ASI06。核心观点:自主 Agent 若把一条错误事实存入记忆,犯下的不是一次错误,而是给未来每一次检索到该记忆的决策埋下隐患——攻击会「等待」并延迟爆发。新文章将这一攻击形式化为「延迟记忆投毒」(memory poisoning on a delay),提醒 Agent 记忆系统需要把持久化的错误事实当作安全问题而非普通 bug 来对待。
「编程与Agent」频道最新
- Jetson Thor 本地跑通具身智能栈:Agent 看懂真实房间 — chrismatthieu · 2026-09-05
- 开发者在 Omarchy 上做 Agent Arcade,盯 agent 之余顺手玩游戏 — DanWahlin · 2026-09-05
- Matt Shumer 演示:Astra 驱动的 agent 一天在虚幻引擎做出生存游戏 — mlamping · 2026-09-05
- 智谱 GLM-5.3 带 vision 上线 Baseten:Terminal-Bench 3.0 从 4.6% 跳到 28.3% — baseten · 2026-09-05
- Swarms v15 重建多智能体执行,附 10+ MCP 集成教程 — KyeGomezB · 2026-09-05
- Google GenAI SDK for Kotlin 发布 1.0,支持 Gemini 多平台接入 — rseroter · 2026-09-05