实测 Jev 对比 Luna:140 项标注对 139 比 138,快 4.6 倍且便宜 83%

TheMoonMidas · x · 2026-09-17

开发者 @ajfedor 用 20 条合成供应商回复测试 Typesafe 的 Jev 与 OpenAI 的 Luna(关闭推理),同一评分标准下共 140 个标签:Jev 得 139/140,Luna 得 138/140。更关键的是按公开费率计算,Jev 快 4.6 倍、成本低约 83%。不过 Jev 也暴露校准问题——曾对一条缺失货币信息的回答给出最高置信度。另一开发者基于 Jev 做了代码审查工具,可筛查代码变更并在本地仪表盘展示结果,仓库公开可查。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →