Context7 实测 Jev:快 10-170 倍、便宜 3-20 倍,但复杂推理不行
gaganghotra_ · x · 2026-09-19
Context7 在其解析管线中把 Jev 与 Gemini Flash、DeepSeek 做了 5 项分类任务对比:
- 3 项打平:查询相关性、重复检测、网站适用性
- 1 项大胜:页面分类 85% vs 56%
- 1 项惨败:抓取根选择 27% vs 93%
- 速度:快 10-170 倍;成本:便宜 3-20 倍
结论:单页面级别的分类任务 Jev 有优势,但需要理解整个网站结构的推理任务则完全不行。
「模型」频道最新
- Burkov 提醒:闭源模型思考 token 不透明,计费可能被夸大 — burkov · 2026-09-19
- DiffusionGemma 原生视觉塔实现在手机上近实时目标检测 — bodonoghue85 · 2026-09-19
- 爆料称 DeepSeek v4.1 能自建训练任务并大规模验证 — teortaxesTex · 2026-09-19
- 实测质疑 Jev 准确性:60% 正面硬币被答成 99/1 — JnBrymn · 2026-09-19
- 实测模型概率判断翻车:60/40 的硬币被说成 99/1 — JnBrymn · 2026-09-19
- Pydantic 作者实测 Jev vs Sonnet:成本低 2.6 倍、快 3.7 倍 — samuelcolvin · 2026-09-19