4 张 RTX 6000 跑 DeepSeek 达 539 tok/s,发帖人自曝跑分注水普遍
HankYeomans · x · 2026-10-05
本地部署玩家晒出 DeepSeek V41 Flash 的极限推理成绩:4 张 RTX 6000(TP4 并行)超频后实测解码 539 tok/s、中位数 518 tok/s(+350 core/+6000 mem 稳定超频)。
更重要的是发帖人的行业批评:社区缺少 decode/prefill 的统一测量标准,很多流传的 tok/s 数字在用高度可预测的 prompt 加 drafter 投机解码后还能虚高 20-30%,而多数人没有 4 张 6000 无法复现验证。他呼吁本地 AI 社区建立标准测量方法,并质疑包括他自己在内的所有数字。
「Infra」频道最新
- Thoughtworks 杰出工程师实测:本地模型做 Agentic 编码靠不靠谱 — bibryam · 2026-10-05
- Muse 修复定时任务恢复故障,并强化 cron 监控与 VM 调度 — alexandr_wang · 2026-10-05
- AWS 误封账号且无解释,AI 产品 Wabi 全线宕机超 3 小时 — soleio · 2026-10-05
- Strix Halo 是不是最接近「梦幻本地 LLM 主机」?统一内存 vs 显卡之争 — Robert__Sinclair · 2026-10-05
- 双 DGX Spark 本地跑 GLM 5.3 flash:新配方解码提速 50-90% — swiebertjee · 2026-10-05
- 高通骁龙将为 Meta 与 OpenAI 下一代 AI 助手提供算力 — ryanshrout · 2026-10-05