实测16个模型:TypeSafe Jev 准确率仅排第10
AlexKim · x · 2026-09-19
作者为验证 TypeSafe 的 Jev 是否值得加入技术栈,跑了 16 个模型的评测,结果 Jev 准确率只排第 10。作者先后写了两版结论标题,最终只有一版在数据面前存活——完整过程见该线程后续帖子。
所属事件:16 模型校准实测:Jev 快而诚实但准确率仅列第10(8 条相关)→
「模型」频道最新
- Noam Brown 确认 GPT-6 Astra 思维链可观测,称这是「脆弱的礼物」 — burny_tech · 2026-09-19
- Jev 走红信号:AI 圈愿意拥抱 LLM 之外的新型模型 — BLUECOW009 · 2026-09-19
- QuixiAI 宣布将以 gemma-4-26B-A4B-it 作为开源项目基座 — QuixiAI · 2026-09-19
- Jev 架构争议发酵,爆料者将开源 Qwen3.8 27B 复刻版 — TheZachMueller · 2026-09-19
- Jev 准确率超越 Sonnet 5 检索方案,成本与延迟仅零头 — IanArawjo · 2026-09-19
- 阿里开源医疗 AI 模型:可检测癌症及近 150 种疾病 — giveen · 2026-09-19