独立实测 Bonsai 2 量化模型:准确率约 91% 表现不俗
airesearch12 · x · 2026-09-19
ByteShape 对 Prism-LM 新发布的 Bonsai 2 QAT(量化感知训练)模型进行了独立复测(基于 Qwen3.8 系列),结果约 91%,认为其实际表现相当不错。
该结果为第三方用 Prism 自家 runtime 跑出,而非官方公布的 benchmark 数字,其余评测设置与 ByteShape 此前的 Qwen3.8 评测保持一致。
所属事件:Bonsai 2 QAT 量化模型独立实测:综合基准约 91.5%(2 条相关)→
「模型」频道最新
- 评测者称纯代码启发式策略可在 Craftax 上胜过大模型 — JoshPurtell · 2026-09-20
- OpenAI Codex 全员重置已生效,官方预告周二有大发布 — kimmonismus · 2026-09-20
- Jev 做 PR 审查比 GPT-5.6 Luna 快 1.93 倍,单次仅 $0.0014 — aniketmaurya · 2026-09-20
- 果蝇连接组国际象棋模型击败 Jev,Labonne 再战一个 — maximelabonne · 2026-09-20
- Bonsai 2 27B 安全护栏砍掉近 20 分,SWE-bench 与 Terminal-bench 成绩大缩水 — julianharris · 2026-09-20
- 小米 MiMo-V2.6 直播 RL 训练:每步 20 亿 token,斯坦福 Marin 同步直播预训练 — stanfordnlp · 2026-09-20