开启推理模式分值激增,Ornith 1.5 35B 实测 GPQA 提升至 81.8
MikePFrank · x · 2026-08-23
评测显示,开启 thinking mode 后,Ornith 1.5 35B 在 GPQA-diamond 上的得分从 52.0 飙升至 81.8,提升约 30 分,使其媲美最佳 27B 密集模型。该模型在单张 RTX 5090 上以 Q4KM 量化运行时,解码速度高达 303 tok/s,且在 32k 上下文下仍能保持 258 tok/s。标准评测方面,MMLU 82.2,GSM8K 91.7。NVFP4 构建版本在 vLLM 上表现一致。
「Infra」频道最新
- 大神为 AMD GFX906 显卡优化了 llama.cpp — milpster · 2026-08-23
- Nvidia AI 服务器涨价超 15%,GB300 售价约 60 万美元 — zephyr_z9 · 2026-08-23
- ROCM 在 Windows 平台上的生成速度是否值得切换? — Low-Location5266 · 2026-08-23
- AI 算力非黄金,GPU 贬值快致金融衍生品失效 — AccBalanced · 2026-08-23
- 为应对未来算力需求,轨道数据中心或成必然 — RachelVT42 · 2026-08-23
- 单卡 RTX 5090 跑 Qwen3.8-27B 262K 上下文实测 — Fz1zz · 2026-08-23