百万 token 窗口仍不够:Chroma 18 模型测试揭示 context rot
Efficient_Joke3384 · reddit · 2026-09-08
核心论点:大窗口与记忆是两笔独立投资,前者不能取代后者
- 上下文窗口已达百万 token(Llama 4 Scout 1000 万,Magic 有 1 亿 token 模型),但「窗口够大记忆就不重要」的假设站不住脚。
- 大窗口只解决「装得下」的问题,仍有三个未解难题:
- 会话结束即清零,下一轮从零开始;
- 准确率随内容增多而下降——Chroma 的 context rot 研究测了 18 个模型,性能在远未触及窗口上限前就开始退化,单个无关干扰项就能显著拉低准确率;
- 每次都要重复付费重处理同样的上下文。
- 作者主张记忆需独立演进:更好的近期性处理、对返回记忆内容加置信度信号等,而不是等窗口变大来兜底。
「编程与Agent」频道最新
- 让 Gemini 从 Gmail 提取数据填入 Google 表格 — omooretweets · 2026-09-08
- Codex CLI 复制技巧:Ctrl-O 以 Markdown 复制,/copy 只取相关片段 — gabrielchua · 2026-09-08
- herdr 0.9.0 发布:一个客户端统管本地与远程机器上的 AI Agent — ycombinator · 2026-09-08
- 实测 Grok Bot 云端智能体团队:像雇一个小组织替你干活 — RachelVT42 · 2026-09-08
- Agent Skills 脚本该预写还是现场生成?权衡与示例 — dotey · 2026-09-08
- 开源 embedflow 零停机迁移 embedding,免 108 天全量重算 — Potential_Low_1183 · 2026-09-08