340M 开源模型零样本跑赢微调基线,临床任务 12/12 全对
MaziyarPanahi · x · 2026-09-29
开发者 Maziyar Panahi 分享实测:fastinoAI 的开源模型 GLiNER2.5-Decide 仅 340M 参数,在 CPU 上零样本运行、未微调任何权重,就在两项临床 NLP 任务上取得 12/12 满分,与微调模型 Jev 持平:断言状态(assertion status)与过敏记录(allergy documentation)。
全量成绩为 36/48,仍低于 Jev 的 48/48,但 zero-shot 表现已相当惊人。作者在征集谁愿意用临床笔记对它做微调,看能否补齐剩余差距。
所属事件:340M开源小模型零样本完成12项临床任务(2 条相关)→
「模型」频道最新
- PrivacyBench v2 发布:flow-transform 1.0 以 95.84% 登顶企业去标识化评测 — Exp_Mark · 2026-09-29
- Grok 4.7 xHigh 登顶 Artificial Analysis 网络安全指数 — XFreeze · 2026-09-29
- 开发者反复核对基准数据:新模型与 Opus 5.5 形成互补 — giansegato · 2026-09-29
- Mike Krieger 谈 Sonnet 5.5 用法,并预告 Haiku 5.5 数周内发布 — mikeyk · 2026-09-29
- 爆料称 OpenAI GPT-6 sol 被 Claude Sonnet 5.5 大幅碾压 — ns123abc · 2026-09-29
- Databricks 实测:Opus 5.5 降本 20%,GPT-6 Luna 便宜 20 倍 — pwendell · 2026-09-29