两个 3GB 小模型加一个裁判:64% 临床决策本地完成,准确率 91.9%
MaziyarPanahi · x · 2026-10-08
开发者 MaziyarPanahi 展示了一套单机多模型级联方案:两个 3GB 本地小模型回答 669 个临床决策问题,再用 Mistral Large 4 做二次仲裁。
- 工作流:两个小模型独立作答,答案一致即采纳;不一致或遇到紧急/红旗类问题时升级给 Mistral Large 4 裁决
- 结果:64% 的决策完全在本地完成,总体准确率 91.9%,无严重漏判,与单独使用 Mistral 相当
- 评分沿用与原榜单一致的严格标准,基于各模型记录的答案计算
这套「本地模型先行、云端大模型兜底」的分诊架构对成本敏感、隐私敏感的应用场景有直接参考价值。
所属事件:双3GB本地小模型级联完成64%临床决策(2 条相关)→
「编程与Agent」频道最新
- LangChain 发布 Managed Deep Agents v0.9:智能体可自建定时任务 — LangChain · 2026-10-08
- Vercel AI SDK 周下载量突破 3000 万,一年内增六倍 — lgrammel · 2026-10-08
- GitHub HydraFusion 支持本地模型路由,微软推 3-bit 256K 版 MAI Code 1.1 — BenBajarin · 2026-10-08
- Devin Mobile 实机演示:云上 Agent 随时随地跑在 Linux/Mac/Windows — DevinAI · 2026-10-08
- 开源工具 GodTerm 把多个 Claude Code/Grok 账号聚合进一个终端 — Daniel_Farinax · 2026-10-08
- Jeffrey Emanuel 自制「say no to 流程仪式」agent skill,日均使用数百次 — doodlestein · 2026-10-08