RTX 5070 12GB 本地实测:社区模型延迟仅为同类本地 LLM 的四分之一
Storge2 · reddit · 2026-10-02
作者在 RTX 5070 12GB 上将本地模型 Jev 1.13(社区微调版 Jebadiah 9B V2,基于 Qwen 3.5 9B)与 4 个本地 LLM 对比,跑 20 项任务并附测试截图。结论是同等质量下延迟仅为对比模型的约 1/4,作者称表现『amazing』。属于社区个人基准测试,样本量小,仅供参考。
所属事件:RTX 5070 本地实测:9B 微调模型延迟仅为同类四分之一(2 条相关)→
「模型」频道最新
- 「决策模型」大战:OpenAI、Perplexity 紧急跟进 Jev — bendee983 · 2026-10-02
- 把江户参勤交代动画交给 Claude 改造,设计效果惊艳 — tkasasagi · 2026-10-02
- 马斯克转评:AI 已在会计测试中碾压人类,18 个月前还不及格 — elonmusk · 2026-10-02
- Mirostat 还有人用吗?新一代模型是否已不需要采样控制 — ParvusNumero · 2026-10-02
- 本地实测:9B 微调模型延迟降至 1/4,RTX 5070 跑分惊艳 — Storge2 · 2026-10-02
- Bindu Reddy 预告 Fable 5.5 最早下周发布,称将是最强可用模型 — bindureddy · 2026-10-02