Qwen 3.5 122B 本地量化实测
RedParaglider · reddit · 2026-07-15
作者第一次做这类工作,基于自己的需求把 **Qwen 3.5 122B Heretic ROCmFP4 iMatrix** 跑在 Strix Halo 上,并给出了实测结果: - 总参数 122B,激活参数 10B - 显存占用约 60.70 GiB - 速度约 28.45 tok/s - BF16 KLD 为 0.100716 作者还提到如果有人需要非 Heretic 版本,会在算力允许时继续放出。
所属事件:Qwen3.5 122B ROCmFP4 量化版本地实测(2 条相关)→
「模型」频道最新
- Kimi 团队与算力轶事外加一份民间模型榜单 — vista8 · 2026-07-21
- DavidAU 协作版据称提升了 Qwen 3.6 27B 的长上下文 Agent 表现 — My_Unbiased_Opinion · 2026-07-21
- 小语言模型更简短,大模型会把物理过程讲完整 — NickPassig · 2026-07-21
- IMO 2026 模型实测的来源与 Lean 证明链接 — deedydas · 2026-07-21
- Claude Fable、GPT-5.6 Sol、Kimi K3 都拿下 IMO 2026 满分 — deedydas · 2026-07-21
- Kimi K3 接入 Claude Code 工作流做同场对照 — tomcrawshaw01 · 2026-07-21