伯克利论文:LLM 记得你的新指令却仍用旧选择
rohanpaul_ai · x · 2026-10-02
伯克利新论文《When Context Changes: Understanding Update Failures in LLMs》研究 LLM 在上下文中的「更新失败」问题:当用户偏好或截止日期等状态发生变化后,旧版本仍留在上下文里,模型虽然也持有新信息,但注意力会不断漂移回更早的提及,导致仍按旧值行动。
实验发现:在 5 个开源模型上,把注意力往最新值上引导即可修复大部分此类错误,无需重训练;顶级模型在长 agent 日志的 40 个问题里只答对 9 个,但直接给出当前状态后能 40/40 全对。
实践启示:如果你的 agent 需要跟踪任何会变化的状态(偏好、截止日期、配额等),应把当前状态显式写进 prompt,而不是让模型自己去翻历史记录。
「编程与Agent」频道最新
- 先访谈 5 问再写码:滚动网页生成的结构化 Prompt 模板 — aziz4ai · 2026-10-02
- 一条提示词工作流:用 Claude 生成 GSAP 滚动动画单文件网页 — aziz4ai · 2026-10-02
- 让agent改代码后怎么办?求客户定制代码的维护部署方案 — Embarrassed-Survey61 · 2026-10-02
- Cloudflare 推出 AI Gateway Web Search API,统一接入三家搜索商 — michellechen · 2026-10-02
- 20任务×3重复=120次运行:harness对比评测的隐形成本 — RelationshipRound711 · 2026-10-02
- 蚂蚁内部Tiger Agent曝光:Ling-3.1-flash跨浏览器终端规划办公工作流 — tinkerbellyie · 2026-10-02