Kimi K3 用开源 delta attention 做到百万 token 上下文

theomitsa · x · 2026-07-26

这条引用强调,Kimi K3 是一个前沿规模的开源模型,并采用了名为 delta attention 的新机制,不再依赖不断增长的 KV cache。

核心卖点是:这种设计让模型能够处理百万级 token 上下文,同时避免显存占用失控。后文还从 attention 的基本原理讲起,解释这种做法为什么重要。

所属事件:月之暗面发布 Kimi K3 万亿参数模型(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →