Elvis 实测 Jev:新原语解锁 Agent 更多玩法
AI 研究者 Elvis Saravia 分享了将 Jev 集成到自建 agent harness 的初步体验,表示对结果非常兴奋。他认为时间线上多数 demo 只展示了 Jev 快和便宜,真正值得关注的是它作为新原语能解锁的新玩法,例如用其搭建自定义评测环境,考察模型能解锁哪些新能力。另有作者整理指南,指出 Jev 这类 System One 专用模型在持续评测与监控、自定义验证器支持长程 agent、递归自我改进三方面尤其值得关注。
2026-09-19 ~ 2026-09-20 · 4 条相关
- 第 1 集:TypeSafe 结束隐身发布决策模型 Jev 与新训练法 RLCD(2026-09-16,86 条)
- 第 2 集:TypeSafe AI 发布专用评估模型 Jev,实测速度与成本优势显著(2026-09-16,8 条)
- 第 3 集:Vercel fx 安全审查将换用 Jev 快 18 倍(2026-09-17,3 条)
- 第 4 集:OpenJev 开源:单张 3090 本地复刻 Jev 服务(2026-09-17,3 条)
- 第 5 集:TypeSafe AI 发布决策模型 Jev:不生成文本、只输出结构化决策(2026-09-17,73 条)
- 第 6 集:Jev「只出概率」模型实测引热议,结果分化(2026-09-18,7 条)
- 第 7 集:TypeSafe AI 的 Jev 模型与 RLCD 训练法引热议(2026-09-18,3 条)
- 第 8 集:LangChain 发布 Jev 教程:构建循环式 Agent Harness(2026-09-18,7 条)
- 第 9 集:TypeSafe Jev 模型生态爆发,六大 GitHub 项目覆盖代理与自动交易(2026-09-18,2 条)
- 第 10 集:Jev 走红:面向决策而非对话的轻量 AI 引热议(2026-09-18,4 条)
- 第 11 集:TypeSafe Jev 靠 LLM 概率分类,大厂可轻易复制(2026-09-18,2 条)
- 第 12 集:JevBench 基准发布,242 项决策九模型最高准确率 97.1%(2026-09-19,2 条)
- 第 13 集:TypeSafe AI 发布决策模型 Jev,宣称快 200 倍便宜 400 倍(2026-09-19,7 条)
- 第 14 集:Elvis 实测 Jev:新原语解锁 Agent 更多玩法(2026-09-19,4 条)
- 第 15 集:决策模型 Jev 免费上线 Venice API,只答不写(2026-09-19,3 条)
- 第 16 集:TypeSafe 首个模型 Jev 创 AI Gateway 最快采用纪录(2026-09-19,6 条)
- 第 17 集:16 模型校准实测:Jev 快而诚实但准确率仅列第10(2026-09-19,8 条)
- 第 18 集:开发者实测 Jev 分类模型:50 单全对,成本极低(2026-09-19,4 条)
- Elvis Saravia 实测 Jev:新原语正在解锁 Agent Harness 的更多玩法 — omarsar0 · 2026-09-19
- Elvis 详解新原语 Jev:为 Agent harness 解锁更便宜的扩展策略 — omarsar0 · 2026-09-20
- Elvis Saravia 用 Jev 搭自定义评测环境:更关注模型能解锁什么新能力 — omarsar0 · 2026-09-20
- Jev等System One模型做agent底座的三个看点 — omarsar0 · 2026-09-20