实测 DeepSeek 极低量化版:2.52 位精度表现惊人

nomorebuttsplz · reddit · 2026-08-24

作者测试了 DeepSeek Flash 模型极低量化版本(2.52 bits-per-weight EXL3)与较高量化版本(MXFP4)的差异。发现即使在极低量化下,模型在代码任务和 20 万+ 上下文中表现依然稳健,并未出现明显退化。作者询问社区是否发现特定任务对量化更敏感。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →