JEV 引发热议:模型规模、校准可靠性与微调接口成待解问题
vykthur · x · 2026-09-20
作者 vykthur 认为 JEV 在评测和 agent 自动优化等领域应用前景广阔,并提出三个开放问题:模型有多大、是否基于预训练 LM 构建;除早期第三方测试外,是否有关于校准精度及其失效场景的研究;是否存在改进已识别弱项的手段——即使现在没有,未来是否会开放某种微调 API。
「编程与Agent」频道最新
- 用 Jev 做 Evals 裁判:比 LLM as a Judge 更快更便宜更稳定 — Hacubu · 2026-09-20
- 用 MiniMax 视频模型 + Blender 预演工作流复现建筑动画 — Hailuo_AI · 2026-09-20
- 实测并行采样决策模型 Jev:路由决策约 1 秒,快普通 LLM 十倍 — TigerOk4538 · 2026-09-20
- 全自主交易机器人一夜建成,实测已亏损 31680 美元 — ZeYanjie · 2026-09-20
- 装库变成一句 prompt:开发者列三个正在消失的编程习惯 — BLUECOW009 · 2026-09-20
- mcp-proxmox 发布:用自然语言管理 Proxmox VE 集群 — modelcontextprotocol · 2026-09-20