RTX 5070 12GB 本地实测:社区模型延迟仅为同类本地 LLM 的四分之一

Storge2 · reddit · 2026-10-02

作者在 RTX 5070 12GB 上将本地模型 Jev 1.13(社区微调版 Jebadiah 9B V2,基于 Qwen 3.5 9B)与 4 个本地 LLM 对比,跑 20 项任务并附测试截图。结论是同等质量下延迟仅为对比模型的约 1/4,作者称表现『amazing』。属于社区个人基准测试,样本量小,仅供参考。

所属事件:RTX 5070 本地实测:9B 微调模型延迟仅为同类四分之一(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →