JevBench 榜单更新 v1.4.1:新增六款系统,前三五名不变
airesearch12 · x · 2026-09-24
Benchmark Heaven 发布 JevBench v1.4.1,针对 "Jev-class" 模型新增六个系统,榜单前五名保持不变。
- 最佳新秀:Jev-Omni,一款基于 Gemma 的多模态模型,首次入榜即排名第 7,综合分 51.34
- Jev 1.13.0 仍以 63.29 分稳居榜首
该榜单还提供价格与能力对比、EU 主权托管、数据保密政策等多维筛选选项。
「模型」频道最新
- 用户实测 MiniMax H3 视频生成,疑似训练数据含 Will Stancil 节目 — Kyrannio · 2026-09-24
- 一句话 62 秒建站花费不足 5 美分,小米 MiMo V2.6 Pro 开源模型实测 — socialwithaayan · 2026-09-24
- 换一个对话就放行:用户晒出 ChatGPT 生成自我形象的绕过技巧 — Todesluke · 2026-09-24
- 开源复现缺的不是算法是数据:HF 集合整理 Jev 训练评测数据集 — vanstriendaniel · 2026-09-24
- GPT-6 修好 Opus 搞不定的 UI,作者感叹时代变了 — haltakov · 2026-09-24
- 抛硬币测试暴露 LLM 校准缺陷:模型学不会「不知道」 — airesearch12 · 2026-09-24