Kev 4B 对比 Jev:精度打平,但 Jev 每次请求多算 257 个 token

facethef · reddit · 2026-09-26

Opper 团队将 Jared Palmer 发布的 Apache-2.0 开源微调模型 Kev 4B(基于 Qwen3.5-4B)与 Jev 在同一端点上并列实测,并构建了一套两模型发布之后的新题集来避免训练数据污染。

评测设置

主要发现

结论:开源 4B 微调模型在能力上已能与商业模型打平,而计费口径的差异可能才是实际使用成本的关键。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →