实测决策模型 Jev:两条 prompt 工程经验与本地 27B 对比

colinmcnamara · x · 2026-09-21

作者 Colin McNamara 测试 TypeSafe 的决策模型 Jev 后总结两条实用经验:

作者还将同样的 1000 条人工标注数据跑在自有 GPU 上的开源 27B 模型上:准确率接近(差距 1.4 个点以内),情感任务上校准误差 0.04 对 0.09,速度上 Jev 快 1.8 到 4.5 倍。

所属事件:实测 Jev:选择题加「以上都不对」,开源 27B 追平表现(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →