开源 27B 本地模型准确率追平 Jev,校准还更好

colinmcnamara · x · 2026-09-21

Colin McNamara 把同样的 1000 条人工标注题目跑在自有 GPU 上的开源 27B 模型上,与决策模型 Jev 对比:准确率接近(相差 1.4 个点以内),情感任务上开源模型校准误差 0.04,优于 Jev 的 0.09,但速度上 Jev 快 1.8 到 4.5 倍。

所属事件:实测 Jev:选择题加「以上都不对」,开源 27B 追平表现(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →