Jev 接入 ChainForge 作 LLM 评审,精度追平 Sonnet 5 成本大降
IanArawjo · x · 2026-09-19
开发者 Ian Arawjo 宣布,Jev 现已作为 LLM judge 接入 ChainForge。在同一数据集上的对比显示,Jev 与使用 Sonnet 5 和 GPT-5.4 mini 的评审模型精度相当,但成本仅为后者的一小部分,速度也更快。作者还提供了可在线查看和试用的示例。
「编程与Agent」频道最新
- 临床 agent 99 次调用 14 万 token 仅花 0.0047 美元,开发者实测低成本分诊流 — MaziyarPanahi · 2026-09-19
- Alchemy IaC 框架将支持 Doppler/Infisical 等密钥管理器 — samgoodwin89 · 2026-09-19
- Swarms v16 将推 MCP Deployer,5 行代码把智能体变成 MCP 服务器 — KyeGomezB · 2026-09-19
- 让 Agent 自己部署应用、再当真实用户测试,像高级模糊测试 — lucasmeijer · 2026-09-19
- 开发者经验:禁止 fallback,逼模型把核心功能做对 — Daniel_Farinax · 2026-09-19
- 银行仓库接 AI 问答三个月复盘:模型从来不是难点 — the_darkest_horse · 2026-09-19