Ollama 支持本地运行 Jev 风格决策模型,Nimble 单次决策仅 91ms
mchiang0610 · x · 2026-09-30
Ollama 发布 0.35 版本,新增基于 TypeSafe Jev API 的决策模型支持,通过新的 /v1/systemone 端点在本地一次性回答一组命名问题,适合需要快速决策的场景。
- 适用场景:工单分诊、模型路由、内容/安全审核等实时决策。
- 性能:本地运行免去网络延迟,Nimble 9B 在 M5 Max 的 Pac-Man 实测中平均每次决策仅 91ms,可实时驱动游戏和内容处理。
- 可用模型:nimble(Bespoke Labs 开源 9B 决策模型)、tev1(Together AI 实验性 4B)、tev1:0.8b(0.8B),更多模型及云端版本即将上线。
- 评测:Bespoke Labs 公开基准显示,Nimble 与 Tev1 在 Ollama 上跑出的 13 个人工标注数据集(3880 次决策)平均准确率与云端 Jev 1.13 相当。
- 一条命令即可上手:ollama pull nimble。
所属事件:Ollama 0.35 上线本地决策模型,Nimble 单次决策仅 91ms(3 条相关)→
「模型」频道最新
- 用户实测 GPT-6.1 Sol 疑似遭悄悄降级,输出乱成 3B 模型 — Ferzelibey · 2026-09-30
- 2x 4060 8GB 跑 Gemma 26B:mradermacher 量化实现 75 tok/s — Spiritual_Impress_30 · 2026-09-30
- DeepSeek 向用户发放 6 元 API 赠金,登录 harness 即可领取 — teortaxesTex · 2026-09-30
- 用户爆料:OpenAI 连接 Gmail 后会自行翻查邮件且断开后仍留存 — alexcovo_eth · 2026-09-30
- 网友爆料:DeepSeek 新模型疑为华为昇腾训练 — teortaxesTex · 2026-09-30
- DeepSeek 上线用户反馈渠道:下载 harness 开关即可帮助改进模型 — teortaxesTex · 2026-09-30