Jev 模型 2 秒做完 40 道数学题仅花 $0.0008,准确率持平 GPT-5.4
xeophon · x · 2026-09-23
多轮实测显示新模型 Jev 在极低成本下表现出人意料:
- CEMC 数学竞赛(加拿大 9-11 年级,40 道选择题):Jev 得 60%,2 秒完成全部题目,成本仅 $0.0008;GPT-5.4 关推理得 59% 但花费 $0.017(20 倍),5.4 nano 得 34%、花费 $0.0014(1.6 倍)
- GPQA Diamond:Jev 得 77%,接近 GPT-5.5 关推理或 Fable 5 低推理档,198 题仅用 3 秒、成本 $0.007
核心亮点是极致的速度与成本效率:分数与更大模型接近,但推理开销低了 1-2 个数量级。
「模型」频道最新
- 模型发布疲劳:开发者称新模型提升边际化,够用就好 — Rasmic · 2026-09-23
- 评测者补充:Opus 5.5 与 Astra、Fable 5.1 大致同一档,无明确胜者 — AaronBergman18 · 2026-09-23
- 评测者称 Opus 5.5 综合或为最聪明模型,知识面略逊于对手 — AaronBergman18 · 2026-09-23
- 阿里连发五款 Qwen-Audio-3.1 语音模型,ASR 直降 95% — aigclink · 2026-09-23
- 46,000 字符纯数学代码生成短片,用户盛赞 Opus 5.5 是硅基最强艺术家 — RileyRalmuto · 2026-09-23
- GPT-6 Sol/Luna 价格砍半:$2/$10 与 $0.10/$0.50,智能分数持平 GPT-5.6 — burny_tech · 2026-09-23