Typesafe 推出 Jev 评估模型,宣称评测打分成本可降 400 倍
hardimanjames · x · 2026-09-19
Typesafe AI 宣布其评估模型 Jev 已上线 Braintrust 平台,可作为 evaluation model 使用。用户只需在已有 scorer 的下拉框中把模型切换为 Jev,即可把评测打分成本降低 400 倍。团队表示后续几天会跑更多自己的评测来验证效果。
「编程与Agent」频道最新
- mitsuhiko:认真试用 Web Components 后团队全线转投 React — mitsuhiko · 2026-09-19
- 实测:jev 在真机安卓 e2e 测试比 DeepSeek+视觉方案快约 14.8 倍 — kevinkern · 2026-09-19
- Claude Code 2.1.277 开始支持 AGENTS.md,无 CLAUDE.md 时自动读取 — romainhuet · 2026-09-19
- -render + jev 实验:毫秒级即时渲染的 Generative UI — cramforce · 2026-09-19
- 别照抄编码 Agent 架构:六步法设计知识型 Agent — MaryamMiradi · 2026-09-19
- Jeb 实战用法:给 prompt 分级、判断该拒绝还是该执行 — QuixiAI · 2026-09-19