决策模型JEV日处理token破万亿,四分之一世界500强接入
大模型之路 · wechat · 2026-10-08
TypeSafe 的决策模型 JEV 上线三周日处理 token 达 1 万亿,约 1/4 的世界 500 强已接入。它不生成文字,只输出带概率的结构化判断(Noul 判断陈述、Choice 选项、Score 打分),靠 RLCD 强化学习让置信度校准可信,从而接入自动化管线。
四类高频场景:工单分流(银行分类 BANKING77 上 Clef 达 94.2 macro-F1)、风险门控、浏览器自动化(APUS 开源 fast-browser-use)、内容审核与模型路由(决策模型毫秒级判定复杂度再分派给不同价位模型)。
成本账:1000 条分类任务 JEV 约 $0.0248,而 GPT-6 Luna $0.0921、Claude Opus 高达 $2.88;每百万条消息 JEV $19-44,Gemini/Haiku 达 $344-1025。JEV 中位响应 194ms,与三大 LLM 的 Cohen's κ 一致性 0.80,高于 LLM 彼此间的 0.76。置信度 >0.9 的请求(约 2/3)与 LLM 一致率超 99%,可放心自动执行,形成"快慢分工"。
安全警示:恶意构造内容可带偏 JEV 判定(实测 rm -rf 命令拦截被诱导改变),安全决策必须再过独立沙箱/权限网关。赛道已拥挤:OpenAI Decisions API、Databricks aidecide、Cloudflare Clef、亚马逊 Strands Decider 2B 纷纷跟进。局限:仅文本、64K token 上限、算术不可靠、不能处理通用任务。
所属事件:TypeSafe 决策模型 Jev 爆红:毫秒级判断、日处理 token 破万亿(7 条相关)→
「编程与Agent」频道最新
- Alchemy 搭配 Cloudflare 部署迭代飞快,可直接上云免开本地 dev server — samgoodwin89 · 2026-10-10
- Cursor 创始人自曝 AI 代码接受率 32%,称「我可能没救了」 — keyanzhang · 2026-10-10
- Liquid AI 决策模型 d1 上线 Vercel AI Gateway,支持视觉输入 — maximelabonne · 2026-10-10
- Voyager 下一版将支持在 X 上直接生成可玩游戏 — ravisparikh · 2026-10-10
- Basalt 推理引擎:5090 上跑出 665 tok/s,达 Strata 2.6 倍 — jesdga95 · 2026-10-10
- 开发者感慨:Claude Code 是史上最伟大的电子游戏 — jarrodwatts · 2026-10-10