博主实测神秘模型 Jev:疑似 30B 级,延迟 300ms,关系推理得 0 分
paraschopra · x · 2026-09-19
paraschopra 用 Qwen3-4B 和 400M 参数的 Laya 对神秘模型 Jev 做了对比测试。基于 MMLU 等成绩对比,他怀疑 Jev 约在 30B 参数量级,实测延迟 300ms 也与 30B 模型在好 GPU 上的表现一致。
更有趣的是:在选项之间相互影响的关系选择基准上 Jev 得分 0%,暗示它不仅并行处理问题,可能选项也是并行处理的。结论是 Jev 像一个标准现代模型,但为极速推理做了特定取舍。
所属事件:神秘判定模型 Jev 引发热议:多方实测结论分化(7 条相关)→
「模型」频道最新
- 作者实测 287 个 Jev 开源项目,精选 20 个看清小模型真正用武之地 — chenrongwei · 2026-09-19
- Qwen3.8-Omni-Flash 定价低于 Gemini Flash,多模态基准几乎打平 — The Decoder · 2026-09-19
- GLM 5.3F 实测:擅长 Remotion 但驾驭不了复杂 JS 视频 — 9r4n4y · 2026-09-19
- JevBench v1.2 发布:Jev 1.13 以 75.3 分险守榜首 — airesearch12 · 2026-09-19
- 吐槽某 AI 系统「单任务 3800 美元」还做不出范式级突破 — seanwbren · 2026-09-19
- Jev 补上通用分类器空缺:代码定义标签,无需额外 LLM 调用 — alexcovo_eth · 2026-09-19