Decision 3.0 移植 Core ML:Mac 本地分流千条 PR,每条仅 0.12 秒
emax · x · 2026-10-12
FluidInference 社区将 vLLM Semantic Router 团队的 Decision 3.0 系列开源决策模型转换为 Core ML,可在 Apple 芯片上完全本地运行。
- 实测数据:d3-lite 在 M5 Pro 上对 1000 条 pull request 做语义分流,单条仅 0.12 秒,吞吐 8.3 PR/s,全程不离开 Mac。
- 模型规格:lite(0.8B)/nano(2B)/mini(4B) 三个规格均已转换,基于 Qwen3.5,Apache-2.0 开源,托管在 Hugging Face 的 d3-coreml 仓库。
- 工作原理:与上游契约一致——每个问题一次前向传播,在最后一个 prompt token 处输出 255 路 FP32 概率读出,不生成文本;支持文本、图像、视频多模态请求。
- 原版 Decision 3.0(0.6B 到 27B)宣称在 Jev Decision Index 双榜第一,处于新的 Pareto 前沿。
「编程与Agent」频道最新
- Grok 机器人替用户下单买域名,绑定 XMoney 卡支付 $14 — chrisfirst · 2026-10-12
- 博主用 Codex 搭 AI 制作团队:15 条剪辑从半天缩到 1 小时 — hugobowne · 2026-10-12
- 新论文提出 Harness Learning:不改参数让 Agent 测试时自适应进化 — pmddomingos · 2026-10-12
- Matthew Berman:我已经不装 App 了,直接让 Agent 干 — MatthewBerman · 2026-10-12
- Pedro Domingos 点评:Harness 成了当下 AI 圈的风口 — pmddomingos · 2026-10-12
- AI 时代初级工程师怎么成长为资深?行业缺失的一环 — KlausCodes · 2026-10-12