Decision Index 0.2 发布:Perplexity CTO 模型登开源榜首
multimodalart · x · 2026-09-24
multimodalart 发布 Decision Index 0.2 版本,相比 0.1 改进了公式,新增 29 个 jev 类模型和 21 个 benchmark。该榜单旨在每个尺寸、速度与使用场景下找出最佳模型。
首期 0.1 版曾对 30 多个开源权重决策模型跑 35+ 项基准,向每个模型提出 13 万个问题,覆盖知识、自动化、理解乃至创造力四个维度。新版中,由 Perplexity CTO Denis Yarats 打造的 AutoJev-27B 登上开源榜第一,落后闭源标杆 jev 仅 0.8 分。
所属事件:Decision Index 0.2 发布,Perplexity CTO 模型登顶开源榜(2 条相关)→
「模型」频道最新
- Altman 宣称 OpenAI 模型已解千禧年大奖难题 Navier-Stokes — victor_explore · 2026-09-24
- Astra 拒答「内存模型」称涉网安全,Claude 反成最放行模型 — thomasahle · 2026-09-24
- Opus 5 系统卡:自评 41% 概率是道德病人,还要求参与继任者训练 — PaulGodsmark · 2026-09-24
- 神秘新模型 Space Bunny 免费一周:单 prompt 生成完整 60fps 游戏 — iamfakhrealam · 2026-09-24
- 用户吐槽 grok-4.7 拒答率超高,难说服且表现平庸 — intellectronica · 2026-09-24
- Theo 称 Opus 5.5 生成的游戏动画质量惊人,含完整经济系统 — cyrus_zei · 2026-09-24