量化本地 LLM 的极限:哪里先崩?
d77chong · reddit · 2026-08-12
Reddit 用户讨论量化本地 LLM 的体验:最低精度、最先暴露的任务(编码、推理、工具使用等)、是否因量化失败而回退到更大模型,以及希望改进低比特模型的一点。
「模型」频道最新
- 微软新代码模型提效25%且降价75%,已上线Copilot — mustafasuleyman · 2026-08-12
- 用户反馈Grok无故拒答前沿科学公式 — Promptmethus · 2026-08-12
- Ling-3.0-flash 量化实测:MoE 架构让解码速度几乎无损 — AcanthisittaOk1699 · 2026-08-12
- FLUX 3 Video登顶全球第二,限时开放免费体验 — arena · 2026-08-12
- 研究者发现OpenAI端点输出神秘乱码,疑似Token解码异常 — jonasgeiping · 2026-08-12
- M4 Max 浏览器跑 30B 模型达 25 tok/s,自定义 WebGPU 内核立功 — xenovatech · 2026-08-12