实测 Jev 对比 Luna:140 项标注对 139 比 138,快 4.6 倍且便宜 83%
TheMoonMidas · x · 2026-09-17
开发者 @ajfedor 用 20 条合成供应商回复测试 Typesafe 的 Jev 与 OpenAI 的 Luna(关闭推理),同一评分标准下共 140 个标签:Jev 得 139/140,Luna 得 138/140。更关键的是按公开费率计算,Jev 快 4.6 倍、成本低约 83%。不过 Jev 也暴露校准问题——曾对一条缺失货币信息的回答给出最高置信度。另一开发者基于 Jev 做了代码审查工具,可筛查代码变更并在本地仪表盘展示结果,仓库公开可查。
「编程与Agent」频道最新
- Agent 重试支付易重复扣款,给写操作加唯一 ID 才能查证 — gethackteam · 2026-09-17
- 开发者开源 synathic:用 Postgres 后验校验戳穿 agent 假报成功 — Gallegos_Daniel · 2026-09-17
- Jitsu 推出 Observability Exports,管道日志直连 Datadog 等 5 家平台 — nikola_mr64990 · 2026-09-17
- 开源工具 Hypit 走红:一条命令让 Claude Code 克隆爆款视频并量产 100 个变体 — nikola_mr64990 · 2026-09-17
- Agent harness 横评:Codex、Hermes Agent、Command Code 并列第一 — Teknium · 2026-09-17
- 重度量化的 Qwen 3.8 27B 自主找到无头浏览器测试自己写的代码 — satnl · 2026-09-17