Muennighoff 算账:KV 压缩丢掉 262GB 只留 20KB

Muennighoff · x · 2026-10-11

Muennighoff 在 MIT NLP Seminar 演讲(主题:Infinite test-time scaling 与 prefix sliding)后补充一笔记账:假设 32 层稠密模型、4096 隐藏维度、bf16、500K 上下文、5K 压缩窗口,KV cache 约 262GB,而 compaction 压缩后只剩约 20KB——丢掉 262GB 换来 20KB,效率极低。

他认为 compaction 虽能让模型长时间自主工作数周去解决难题,但效率太差;「最终 boss」是用别的机制取代 compaction。

所属事件:OpenAI 研究员 MIT 开讲无限测试时扩展(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →