不生成文本的模型 Jev 实测:精度追平 GPT-6 Astra,成本仅 1/500
JenniferHli · x · 2026-10-09
评测机构 Vals AI 独立测试了 TypeSafe 的 Jev——一个不生成文本的模型——在 400 道理赔核验问题上与 11 个模型对比。结果显示 Jev 达到 97.5% 的准确率,与 GPT-6 Astra 持平,而成本约为后者的 1/500。对于只需判真假的核验类任务,专用判别式模型可能是极具性价比的路线。
「模型」频道最新
- GPT-6 被评为最强 AI 写手:自然度大跳级几乎免改稿 — VraserX · 2026-10-09
- 用户实测:GPT-6 疑似无法直接读写已保存记忆 — ItsAGarbageAccount · 2026-10-09
- Claude 美国付费用户 7%+ 订阅百美元档,远超 ChatGPT 的 1% — omooretweets · 2026-10-09
- 用户发现新 Chat 模式里只有 Instant 真是 GPT-6,Middle/High 疑似仍是 5.6 — Deadline_Zero · 2026-10-09
- Anthropic 红队:GLM-5.3 安全护栏 64%-100% 可被简单绕过 — dl_weekly · 2026-10-09
- 600M 模型浏览器内 160ms 分类语音备忘,全程不上传 — iamrobotbear · 2026-10-09