三元LLM复兴?多款1.58-bit模型发布,性能逼近全精度
Individual-Dot5488 · reddit · 2026-08-16
Reddit用户讨论三元(1.58-bit)LLM是否正在复兴。近一个月内,多个实验室发布了三元模型:
- PrismML 发布27B三元模型,但社区反馈其基准测试表现不稳定。
- Deepgrove 发布三元模型 maple-20b-a1b,在iPhone上运行速度约100 tok/s,体验良好。
- Doses AI 发布医疗专用三元模型 pestle-27b-ternary,在医疗基准上全面超越 medgemma-27b,体积小8倍(约8.5GB)。
共同问题是长程agentic编码/工作能力不足,但用户认为这是因为这些新实验室尚未进行强化学习优化,且已表示下一步将重点投入。用户期待出现能与Qwen3.8在编码和agentic任务上竞争的大规模三元MoE模型。
「模型」频道最新
- Gemini 3.7 Flash 亚语种能力未升反降 — SebastianNehrd2 · 2026-08-16
- Goal 指令令 token 暴涨 13 倍却仅微弱提分 — zainhas · 2026-08-16
- Sonnet 性能无提升却用双倍 Token — zainhas · 2026-08-16
- Grok 的自动模式获赞:简单请求快,复杂问题也能解决 — mark_k · 2026-08-16
- Qwen 3.8 27B 能否超越 Qwen 3.5 122B?社区热议 — MackThax · 2026-08-16
- Sonnet 5 数据惨烈碾压 Sonnet 4.5 — zainhas · 2026-08-16