RTX 5070 本地实测:9B 微调模型延迟仅为同类四分之一

有用户在 RTX 5070 12GB 显卡上本地部署社区微调模型 Jev 1.13(基于 Qwen 3.5 9B 的 Jebadiah 9B V2),并与 4 个本地 LLM 在共 20 项任务上进行对比测试。结果显示该微调模型的延迟仅为同类本地 LLM 的四分之一,跑分表现令人惊喜,引发社区关注。

2026-10-02 ~ 2026-10-02 · 2 条相关