斯坦福论文:模型选上下文还是参数记忆,方向可干预但难跨任务复用
niloofar_mire · x · 2026-09-03
斯坦福团队在 arXiv 发布论文《How Do Language Models Choose Between Context and Memory?》,研究模型在上下文信息与参数化知识冲突时如何抉择。
- 从「一致提示」中估计 authority 方向,并在匹配提示间交换这些方向的坐标。
- 在 Qwen、Llama、OLMo 上,该干预可复现 30-68% 的权威性偏移,而对照几乎无效,说明这些方向有因果作用。
- 跨任务复用实验:仅在给定任务上学到的方向能缩小 57% 的权威差,跨任务方向只缩小 9%。
- 结论:authority 计算是任务相关的,方向不能直接跨任务复用,需区分表示、因果使用与跨任务因果复用三个层面。
「研究」频道最新
- LagTag 染色质记录研究正式发表,AI 助力基因史追踪 — arjunrajlab · 2026-09-03
- SIGGRAPH Asia 2026 差旅资助开放申请,9 月 18 日截止 — tomaszbednarz · 2026-09-03
- 100 个已知错误实测 AI 同行评审:最强系统抓 71 个,多模型集成达 93 个 — alejandroll10 · 2026-09-03
- EMNLP 论文:从零预训练对比发现罗马化文本跨语言迁移最优 — TuhinChakr · 2026-09-03
- HydroGym 登 Nature:60+ 环境训练 AI 控制流体力学 — ricardovinuesa · 2026-09-03
- 让 Agent 活过模型更替:新论文把持久身份与可换组件分离 — omarsar0 · 2026-09-03