Peter Gostev 辨析模型稀疏度爆料:Kimi 26:1、DeepSeek 32:1,1.2T 激活参数不可信

inductionheads · x · 2026-09-07

Peter Gostev 针对「OpenAI 某模型有 1.2T 激活参数」的网传爆料提出质疑。他算了一笔 MoE 稀疏度账:Kimi k3 总参数 2.8T、激活 104B,稀疏比约 26:1;DeepSeek v4 更稀疏,1.4T 总参数对应 49B 激活,约 32:1。他反问:OpenAI 没理由突然把稀疏比降到 5:1 或 10:1,按行业趋势只会更稀疏,因此「1.2T 激活」的说法根本编不圆,爆料可信度很低。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →