三元权重模型 Bonsai 2 27B 达 Qwen IMO 成绩 95%,速度还快 30%
tensorqt · x · 2026-09-25
PrismML 团队发布了三元量化(ternary)模型 Ternary Bonsai 2 27B,并公布了在 2026 年 IMO 问题上的实测对比。测试条件苛刻:无联网、无工具、13.1 万 token 推理预算。结果显示,Bonsai 2 拿到了人类铜牌区间的上段成绩,保留了全精度 Qwen3.8 27B(54GB)95% 的 IMO 得分,而完成题目耗时仅为后者的 70%;对比的 Gemma 4 12B QAT 模型仅约 7GB。这一结果展示出三元量化在强推理任务上的性价比潜力,代码已开源。
「模型」频道最新
- Bespoke Labs 推出 AutoResearchExam:29 项开放 ML 研究任务测智能体 — AlexGDimakis · 2026-09-25
- 视觉模型梯队图更新:Opus 5.5、GPT-6 双版本与 Grok 4.7 入列 — ducha_aiki · 2026-09-25
- 爆料:Anthropic 新模型发布数周后惯常被降智 — iannuttall · 2026-09-25
- TypeSafe AI 推出 Jev:不做文本生成、专管 agent 运行中 bounded 决策的「System One」模型 — hardimanjames · 2026-09-25
- 实测:Qwen Flash Next IQ4_XS 四项基准全面胜过 27B FP8 — smallDeltaBigEffect · 2026-09-25
- Theo 感慨想念旧版 Claude「Fable」的味道,网友:不再给 Dario 交钱 — teortaxesTex · 2026-09-25