4张5060 Ti本地跑DeepSeek:128k上下文速度实测
Ambitious_Fold_2874 · reddit · 2026-08-01
一位开发者在 Reddit 分享了使用 4 张 5060 Ti (16GB) 显卡搭配 4 通道 DDR4 3200 内存,通过 llama.cpp 本地运行 DeepSeek 模型的实测速度。
在 128,000 的上下文窗口下,该配置实现了约 200 tps 的 Prompt 处理速度和约 11 tps 的 Token 生成速度(-ub/-b 参数设为 4096)。
所属事件:开发者实测四张5060Ti本地部署DeepSeek(2 条相关)→
「Infra」频道最新
- 传欧洲芯片巨头 NXP 拟收购自动驾驶 AI 芯片厂商 Ambarella — pstAsiatech · 2026-08-01
- 消费级笔记本跑通2.78万亿参数Kimi K3全量模型 — rickasaurus · 2026-08-01
- CXMT LPDDR6 内存接近量产,速率达 12800Mbps — bookwormengr · 2026-08-01
- OpenAI 巨型单体仓库遇性能瓶颈,团队向 Git 上游提交优化补丁 — charliermarsh · 2026-08-01
- 算力账单揭秘:国产大模型在AI编程场景为何“叫好不叫座” — 创业邦 · 2026-08-01
- Taalas 将 Llama 3.1 烧录进定制芯片,推理速度达 1.5 万 tokens/秒 — generativist · 2026-08-01