37 项基准 13 万次决策:单卡 RTX 6000 Pro 实测本地模型排行
multimodalart · x · 2026-09-22
multimodalart 公布本地模型基准测试:37 项基准、5 大类别,每个模型累计 13 万次决策,全部在单张 RTX 6000 PRO 上运行。榜单前列还包括支持 Qwen3.8-27B 与 diffusion gemma 单次推理的技术(无需微调),第三名 Decider 35B-A3B 是 Qwen3.5 35B base 的强力微调版。
所属事件:Decision Index 0.1 发布:13 万次提问实测 Jev 与 30+ 开源决策模型(7 条相关)→
「模型」频道最新
- Claude 按Token计数不按条数,9 招避免额度爆掉 — HeyAmit_ · 2026-09-22
- 疑似 OpenAI「Aeon 持久 Agent」新信息流出,截图曝光 — PrisonOfH0pe · 2026-09-22
- 新基准 Decision Index 0.1 跑 13.2 万次决策,Jev 仍以 59.5 居首 — victormustar · 2026-09-22
- 网友用 Pelican SVG 测试对比 GPT-6 Astra 与 Anthropic 新模型 — PrisonOfH0pe · 2026-09-22
- Reddit 用户反映 Gemini Pro 网页搜索功能疑似被禁用 — zsolt67 · 2026-09-22
- M5 Ultra 跑 Qwen 达 3740 tok/s prefill,一天内翻倍震惊业界 — EAccelerate_42 · 2026-09-22