别等更大上下文窗口:多智能体横向扩展才是长文本正解
bingxu_ · x · 2026-09-13
INT21 工程博客 + 网友评论的组合内容:
- 核心论点:INT21 认为,更大的上下文窗口并不能解决长上下文问题,真正的突破是多智能体编排——把一个千万 token 级的问题拆成一组协同的、各自找证据的小任务。
- 实践案例:作者一年前尝试让 AI agent 生成 NVIDIA CUTLASS C++ 内核时,整个 CUTLASS 代码库约 500 万 token,而当时最好模型只有 100 万 token 窗口。瓶颈不在代码生成,而在跨仓库找到并保持正确证据。解法是把 100 万 token 模型并行跑多次,每个 agent 研究代码库不同部分,最后合并结论——「上下文装不下时,横向扩展」。
- 为什么大窗口不等于好上下文:即使几百万 token 塞得进窗口,模型仍要从噪声中分离信号;更大窗口带来更多无关信息、更多中间输出和注意力竞争,多智能体从结构上解决了这个问题。
- 附带观点:转发者 bingxu 认为 Dario(Anthropic CEO)低估了华为与长鑫存储(CXMT)——华为 IC 设计只落后一代,且其光通信积累意味着华为具备独立搭建先进 MoE pod 的全部要素。
「编程与Agent」频道最新
- Grok Build 连发 v1.0.29/30:修 tmux 卡顿、新增 Ctrl+G 与多进程崩溃修复 — XFreeze · 2026-09-13
- Codex harness 空转轮询狂烧 token,作者给出省钱用法 — brandon_galang · 2026-09-13
- LLM 评测跑两次结果不同是回归还是噪声?作者公开判别方法 — bgoncalves · 2026-09-13
- AI 编程时间分配建议:两成让 AI 写,八成自己用 — Daniel_Farinax · 2026-09-13
- OpenAI 晒 GPT-6 Astra 社区成果:3D 解剖、Unity 空管模拟器等十余个项目 — OpenAIDevs · 2026-09-13
- 一个 GitHub 仓库收录 500+ 个 Agentic AI 项目,可找灵感与学实现 — Roger_M_Taylor · 2026-09-13