Context Language Models 论文原稿:把上下文当文件让模型自管,成绩与细节一览
alex_verem · x · 2026-10-05
这是 Meta 与 UW 团队 Context Language Models 论文的 arXiv 原文(arXiv:2609.37725),作者包括 Rulin Shao、Pang Wei Koh、Luke Zettlemoyer 等。核心做法是把上下文视为文件,允许模型无限制地更新自身上下文,多 agent 场景下各上下文以文件形式共存。
摘要中的量化结果:BrowseComp-Plus 上准确率高 11.4%、FLOPs 省 21.5%;12 小时 EdgeBench 高 5 分、省 59% FLOPs;24 小时多仓库 agent 集群任务同算力下改进多 65%。通过 skill-optimization 演化出的自然语言指令可将 held-out 准确率提升至多 35.9 分;在线 RL 让 Qwen3.5-9B 提升 47.6% 且省 12% FLOPs。还设计了 Suffix Cache Reuse 服务端优化,较标准 SGLang 再省 35% 服务端算力。
所属事件:Meta 与 UW 提出上下文语言模型:让 LLM 自主编辑自身上下文(4 条相关)→
「编程与Agent」频道最新
- Karpathy 谈读懂数学模型输出:用 ASD-STE100 与图表让 LLM 更易读 — dair_ai · 2026-10-05
- 开发者把编码 Agent 界面改造成 iMessage 风格,称生活更美好了 — davidfromkansas · 2026-10-05
- Reddit 网友用游戏本+iPhone+Tailscale 搭起本地 AI Agent 网络 — Due_Recording_5802 · 2026-10-05
- 单工具全过却整链失败:实测揭示 MCP 测试必须跑完整工作流 — Stock-Pumpkin-8859 · 2026-10-05
- 网友点子:AI agent 别只演示订机票,试试报税和记账这些真活 — vivekhaldar · 2026-10-05
- 亚马逊 2B、Cloudflare 9B/27B 开源决策模型挑战 Jev — mark_k · 2026-10-05