用户讨论 Qwen3.6 本地部署,27B 和 35B 各有用法
nonlinearsystems · reddit · 2026-07-24
一条 Reddit 讨论在问大家是怎么实际使用 Qwen3.6 的;一位用户分享了自己在 Mac Studio M3 Ultra 96GB 上的本地跑法。
- 35B 配 Hermes Agent,27B 用于编程任务,搭配 Pi Agent。
- 两个模型都通过 LM Studio 以 8bit 方式运行。
- 他认为 27B 的 GGUF MTP 版本比自己试过的 MLX 版本更好用。
- 他的偏好上下文长度是:27B 用 128k,35B 用 64k;Hermes 主要拿来做通用个人助理任务。
「模型」频道最新
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 开源 LLM 排行榜与定价对照目录,一站式索引比较工具 — Last_Establishment_1 · 2026-09-11