用户讨论 Qwen3.6 本地部署,27B 和 35B 各有用法
nonlinearsystems · reddit · 2026-07-24
一条 Reddit 讨论在问大家是怎么实际使用 Qwen3.6 的;一位用户分享了自己在 Mac Studio M3 Ultra 96GB 上的本地跑法。
- 35B 配 Hermes Agent,27B 用于编程任务,搭配 Pi Agent。
- 两个模型都通过 LM Studio 以 8bit 方式运行。
- 他认为 27B 的 GGUF MTP 版本比自己试过的 MLX 版本更好用。
- 他的偏好上下文长度是:27B 用 128k,35B 用 64k;Hermes 主要拿来做通用个人助理任务。
「模型」频道最新
- 有人把“Gemini 为什么这么差”做成了梗图 — Samael111342 · 2026-07-24
- 马斯克发图力挺 Grok 4.5,称其性价比全场最优 — elonmusk · 2026-07-24
- GPT-5.6 Sol 通关游戏 Act 1 Boss 展现实测能力 — whimsical_fae · 2026-07-24
- 微软称 MAI 模型让 PowerPoint 成本降 84%、OneDrive 保存率升 26% — AmyKateNicho · 2026-07-24
- 一则 Claude 代码注释样例,引出 GPT-5.6 Sol 的可读性对比 — Sauers_ · 2026-07-24
- Gemma 4 本地编码实测:后端可用,前端 UI 仍拉胯 — curiousily_ · 2026-07-24