本地实测:9B 微调模型延迟降至 1/4,RTX 5070 跑分惊艳

Storge2 · reddit · 2026-10-02

Reddit 用户在 RTX 5070 12GB 上将本地部署的 Qwen 3.5 9B 微调版(Jebadiah 9B V2)与 4 个本地 LLM 对比,共 20 项任务。

结果显示:同等质量下,该 9B 模型延迟降低了 4 倍,作者称效果令人惊讶。

所属事件:RTX 5070 本地实测:9B 微调模型延迟仅为同类四分之一(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →