Context Language Models 论文原稿:把上下文当文件让模型自管,成绩与细节一览

alex_verem · x · 2026-10-05

这是 Meta 与 UW 团队 Context Language Models 论文的 arXiv 原文(arXiv:2609.37725),作者包括 Rulin Shao、Pang Wei Koh、Luke Zettlemoyer 等。核心做法是把上下文视为文件,允许模型无限制地更新自身上下文,多 agent 场景下各上下文以文件形式共存。

摘要中的量化结果:BrowseComp-Plus 上准确率高 11.4%、FLOPs 省 21.5%;12 小时 EdgeBench 高 5 分、省 59% FLOPs;24 小时多仓库 agent 集群任务同算力下改进多 65%。通过 skill-optimization 演化出的自然语言指令可将 held-out 准确率提升至多 35.9 分;在线 RL 让 Qwen3.5-9B 提升 47.6% 且省 12% FLOPs。还设计了 Suffix Cache Reuse 服务端优化,较标准 SGLang 再省 35% 服务端算力。

所属事件:Meta 与 UW 提出上下文语言模型:让 LLM 自主编辑自身上下文(4 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →