社区正在测试 GLM-4.5-Air 在 llama.cpp 的 MTP 支持
jacek2023 · reddit · 2026-08-04
Reddit 上有人请求社区帮忙测试 GLM-4.5-Air 在 llama.cpp 里的 MTP 支持,指向了 PR #26534。
帖子说明需要一个带 MTP layer 的 GGUF,并提到 Unsloth 版本可能已经包含该层。
「Infra」频道最新
- MiniMax H3 全量 bf16 跑满 95GB 显存,15 秒视频耗时 2 小时 — Moarkush · 2026-08-04
- 重置 Windows 后,RTX 3070 的本地 Qwen3.6-35B 吞吐恢复了 — campaigner_ · 2026-08-04
- Emmy 降低 RTX 5090 上 Gemma 4-12B 首 token 延迟,但吞吐几乎不变 — NoVibeCoding · 2026-08-04
- Databricks 年化收入突破 40 亿美元,累计融资接近 218 亿美元 — thedealdirector · 2026-08-04
- AI 指数在 2024 年末后陡增 5 倍,算力转向推理和后训练 — ProfBuehlerMIT · 2026-08-04
- DeepSeek V4 Flash 量化版本本地性能实测:Q3 比 Q8 快数倍 — Spicy_mch4ggis · 2026-08-04