PrismML 发布 Bonsai 2 27B:比 Qwen3.8 小 9 倍,性能保留 98.2%
ivan_bezdomny · x · 2026-09-19
PrismML 开源发布 Ternary Bonsai 2 27B,采用三值权重压缩 Qwen3.8 27B,显存占用降至 5.9GB,聚合基准成绩保留 98.2%,Apache 2.0 协议开源。
- 可在浏览器中通过 WebGPU 完全本地运行,或跑在 RTX 3060 等 12GB 消费级显卡上;RTX 3060 实测支持 220K 上下文、解码约 35 tokens/s
- 主要面向 agentic 负载:多模态推理、agentic coding、长程工具调用;相比第一代 27B,多步任务中的静默失败与跑偏明显减少
- 团队称在 RTX 5090 上可本地跑 computer-use 工作流
所属事件:Bonsai 2 27B三值量化发布,5.9GB保留98.2%性能(20 条相关)→
「Infra」频道最新
- 蒙特利尔 Exploit Summit 亮点:Bittensor 生态大版图一览 — markjeffrey · 2026-09-29
- Bain 测算:AI 到 2031 年需年入 6 万亿美元才能撑住算力建设 — sanjaykalra · 2026-09-29
- 实测打脸:DGX Spark 上 bf16 反而比 int8 convrot 更快,H3 视频生成差 14 秒 — dtdisapointingresult · 2026-09-29
- BAAI 推出 MALA 注意力:128K 上下文训练延迟降 2.2 倍 — BAAI · 2026-09-29
- BAAI CoWA 注意力架构:全因果覆盖改为集体属性,训练延迟降 7.4 倍 — BAAI · 2026-09-29
- Databricks 用 AI 智能体登顶 NVIDIA 内核榜单,总花费仅约 7 万美元 — Yuchenj_UW · 2026-09-29