340M 小模型零样本临床任务 12/12,平察大模型表现
MaziyarPanahi · x · 2026-09-29
Maziyar Panahi 测试了 fastinoAI 刚发布的 GLiNER2.5-Decide(340M 参数)在临床 NLP 任务上的零样本表现:在纯 CPU 上运行,断言状态(assertion status)和过敏记录两个任务全部 12/12 命中,与更大模型持平;完整测试集为 36/48。作者未微调任何权重,并计划下一步用真实临床笔记做临床微调(处理缩写、用药变更、跨笔记矛盾),在未触碰的测试集上验证,并向社区征求建议。
所属事件:340M开源小模型零样本完成12项临床任务(2 条相关)→
「模型」频道最新
- Every 实测 Claude Sonnet 5.5:比 Sonnet 5 快 30% 且更便宜 — danshipper · 2026-09-29
- 用户实测:切换 Claude Opus 5.5 后再没回头用过 Fable 5.1 — haider1 · 2026-09-29
- Sonnet 5.5 发布获「Opus 级」升级,写作能力反超旗舰 — every · 2026-09-29
- 实测 Jev 跑推理密集型回归任务:快但准头一般 — dbreunig · 2026-09-29
- 一年后再画同题画作,网友感叹 Claude 模型艺术功力大增 — IllustriousWorld823 · 2026-09-29
- OpenAI 与 Anthropic 模型对决前瞻:6.1 Astra 明日或迎关键一战 — karmay007 · 2026-09-29