双卡实测:DeepSeek v4 跑出 67 t/s
koalfied-coder · reddit · 2026-08-30
用户分享使用 2 张 GX10 显卡运行 DeepSeek V4 模型的实测结果,实现了超过 65 tokens/s 的持续生成速度,并强调 2570 长上下文评估的重要性。
「Infra」频道最新
- 19 种通用延迟优化模式,加速 AI 应用响应 — blaizedsouza · 2026-08-30
- 异构GPU实测Qwen3.8-27B:eGPU层分模式与MTP加速全解析 — CoffeeToCode99 · 2026-08-30
- llama.cpp 待合 PR 汇总:CPU/混合推理提速 — pmttyji · 2026-08-30
- Zoubin Ghahramani:数据中心本质上是将电力转化为可用的智能 — irinarish · 2026-08-30
- Enter Cloud 提供全栈式开发基础设施 — FellMentKE · 2026-08-30
- Applied Compute 发布 AC2 私测版:打造模型工厂基础设施 — ypatil125 · 2026-08-30