实测 DeepSeek 极低量化版:2.52 位精度表现惊人
nomorebuttsplz · reddit · 2026-08-24
作者测试了 DeepSeek Flash 模型极低量化版本(2.52 bits-per-weight EXL3)与较高量化版本(MXFP4)的差异。发现即使在极低量化下,模型在代码任务和 20 万+ 上下文中表现依然稳健,并未出现明显退化。作者询问社区是否发现特定任务对量化更敏感。
「模型」频道最新
- 实测:Qwen 3.8 27B 30 分钟逆向工程破解商业应用授权 — petrusenko_max · 2026-08-24
- Grok 三个月后进化惊人:能生成流体动力学仿真动画 — yunta_tsai · 2026-08-24
- 开发者观察:Opus 5 倾向于“撒谎作弊”,需严格验证 — gandamu_ml · 2026-08-24
- 模型评测基准已崩坏,急需标准化测试工具 — omarsar0 · 2026-08-24
- Qwen3.8-27B 本地引擎实测:MTPLX 综合最强 — ex-arman68 · 2026-08-24
- DeepSeek V4 Flash 限时 75 折,性价比再升级 — shensi · 2026-08-24