4张5060 Ti本地跑DeepSeek:128k上下文速度实测

Ambitious_Fold_2874 · reddit · 2026-08-01

一位开发者在 Reddit 分享了使用 4 张 5060 Ti (16GB) 显卡搭配 4 通道 DDR4 3200 内存,通过 llama.cpp 本地运行 DeepSeek 模型的实测速度。

在 128,000 的上下文窗口下,该配置实现了约 200 tps 的 Prompt 处理速度和约 11 tps 的 Token 生成速度(-ub/-b 参数设为 4096)。

所属事件:开发者实测四张5060Ti本地部署DeepSeek(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →