DeepSeek V4 Flash 本地量化跑分:MacBook 运行实测
corruptbytes · reddit · 2026-08-09
开发者分享了 DeepSeek V4 Flash 在本地量化环境下的 SlopCodeBench 测试结果。使用 antirez q2-q4 imatrix 量化方案在 MacBook M5 Max 上运行,虽然速度远慢于托管 API,但通过切换测试框架(harness)至 pi 0.84.0,弥补了部分量化带来的智力损失。
跑分对比(Strict 项):
- 本地量化 (run B):5/17 (29.4%)
- Opus 5 (API):4/17 (23.5%)
- DeepSeek V4 Flash (API):3/17 (17.6%)
测试表明,合理的框架配置对本地量化模型的发挥至关重要。
「Infra」频道最新
- 微软披露1350万次Copilot会话:Agent调度不能照搬Chat — rohanpaul_ai · 2026-08-09
- 对比牛肉与数据中心:AI 耗水争议背后的双重标准 — KrustyKrabFormula_ · 2026-08-09
- 零成本本地部署大模型:5步替代 ChatGPT Plus — Aiden_Tech_Ai · 2026-08-09
- 英伟达 Rubin Ultra 架构调整:削减 HBM 转向光互连 — zephyr_z9 · 2026-08-09
- 硬核玩家在安卓手机原生跑 SD:SDXL 出图需 20 分钟 — Silent-Paramedic4063 · 2026-08-09
- LFM 2.6B 本地跑出 260T/s:开发者实测极佳的轻量级助手体验 — Borkato · 2026-08-09